{"as_of":"2026-08-11T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73e391e049c597e8e2c7952d0499de587e75cd8d1d87f9a8bb535b36f013dca7","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:16:03.879115Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T01:57:15.550335Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T14:59:55.959873Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"cited_work":{"arxiv_id":"2412.20725","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20725","snapshot_observed_at":"2026-07-04T14:59:55.959873Z","title":"Dialogue director: Bridging the gap in dialogue visualization for multimodal storytelling","venue":null,"work_id":"2ce62d6e-e3c5-4289-b671-a340c4d8f3a4","year":2024},"citing_paper":{"arxiv_id":"2505.16819","last_updated":"2026-05-19T15:22:52Z","snapshot_observed_at":"2026-08-01T07:12:14.758494Z","submitted_at":"2025-05-22T15:54:42Z","title":"Character-Centered Dialogue Generation from Scene-Level Prompts","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-22T13:31:43.083678Z"},"links":{"cited_paper":"/paper/2412.20725","citing_paper":"/paper/2505.16819"},"observation_digest":"sha256:5f3e9977f0191fcae853989faf9d0d2295417547692b224244ac46b1561e4084","observation_id":"77543878-efb6-4f3d-8c32-9b0fc691b049","resolution":{"observed_at":"2026-05-22T13:34:53.723769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"cited_work":{"arxiv_id":"2412.20725","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20725","snapshot_observed_at":"2026-07-04T14:59:55.959873Z","title":"Dialogue director: Bridging the gap in dialogue visualization for multimodal storytelling","venue":null,"work_id":"2ce62d6e-e3c5-4289-b671-a340c4d8f3a4","year":2024},"citing_paper":{"arxiv_id":"2606.24107","last_updated":"2026-07-03T09:17:12Z","snapshot_observed_at":"2026-08-01T13:42:02.404759Z","submitted_at":"2026-06-23T03:50:28Z","title":"DramaDirector: Geometry-Guided Short Drama Generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-26T01:57:15.550335Z"},"links":{"cited_paper":"/paper/2412.20725","citing_paper":"/paper/2606.24107"},"observation_digest":"sha256:c5ae18e74bcd49778df7fab6070a106fc966f2b392c40d43cb4b5bf62b3a3908","observation_id":"37f0c61c-d26c-4942-9f19-9762a8121cff","resolution":{"observed_at":"2026-07-04T14:59:55.961246Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.20725/citation-record","integrity":"/paper/2412.20725/integrity","json":"/paper/2412.20725/citation-record.json","paper":"/paper/2412.20725"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:03.716571Z","title":"Video generation models as world simulators,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.716571Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:67d01b19c64e755cdcad5b1b5d3bf578a9b5e96be68ab9b45ec02f1780334310","observation_id":"15f84df4-8949-4709-80ab-609fdfa4f2fe","resolution":{"observed_at":"2026-08-10T23:16:03.716571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.420532Z","title":"Video-driven sketch animation via cyclic reconstruction mechanism,","venue":null,"work_id":"f8c72321-ebf0-41bd-a9c8-23a1f4e3d738","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.720606Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:7ce798bfcd4881f4426ce27f2ab0c6b784a9e582341bf26dacd860bf8beb8b48","observation_id":"e8666aff-2b02-4bb8-b8c4-749f45a2e591","resolution":{"observed_at":"2026-08-10T23:16:04.425250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.407162Z","title":"Styleself: Style-controllable high- fidelity conversational virtual avatars generation,","venue":null,"work_id":"4dee4a1e-304b-44a1-a5cd-6aeafb6ff70a","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.724278Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:b79f691fde9a9a15339bc8c7eb19c1e9db60ccc7b917a0833ff02547ee60adf2","observation_id":"f9765e16-912f-4daf-aada-3df10a94cf57","resolution":{"observed_at":"2026-08-10T23:16:04.411374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.393949Z","title":"Training-free semantic video composition via pre-trained diffusion model,","venue":null,"work_id":"72ba6a84-eefb-490e-a99e-d57b2b86f209","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.728278Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:7e3ffdf0138593f8cb9ebd5713a81c03d03ef35e7d21c777007e617dca489fe9","observation_id":"8c70f683-43fe-47f5-89e1-597db6c4e7e5","resolution":{"observed_at":"2026-08-10T23:16:04.398165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.379546Z","title":"Reisz, G","venue":null,"work_id":"87085de9-6d28-4e02-9a79-ad19bccc3a7a","year":2010},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.732032Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:2ff535867782630a5e68275d8f5bab2b113c72e4a0e108db63e6fafcb127df35","observation_id":"a3e1f07d-572d-4a2c-b8fe-f7dc51e95503","resolution":{"observed_at":"2026-08-10T23:16:04.384077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.365854Z","title":"Storygan: A sequential conditional gan for story visualization,","venue":null,"work_id":"710e98eb-a6bd-40eb-af7d-cf6115735f15","year":2019},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.735725Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:459351361011492318a159d1aa1103e2a1c6a6cd7f2c9629b45aeaec7ffe7379","observation_id":"46875828-c4ee-4471-9224-fdd835ac7eba","resolution":{"observed_at":"2026-08-10T23:16:04.370417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.351855Z","title":"Character-preserving coherent story visualization,","venue":null,"work_id":"3cef9978-e84b-413c-a205-e9bd72ea16e6","year":2020},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.739751Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:59f12287a16543a0736f309fd449ccf8360760cc4f2bbf2876d9f01b0873418a","observation_id":"f9f10ea0-4cb3-414f-9ec7-62a0bcaadb61","resolution":{"observed_at":"2026-08-10T23:16:04.356685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.338752Z","title":"Learning to model multimodal semantic alignment for story visualization,","venue":null,"work_id":"ba4af88b-3e2d-4fca-9dec-6ea389811377","year":2022},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.743166Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:09d61bad00388de40145abee104c7e5f3763e1157be19716a86ac9ab0bc02151","observation_id":"39ec40ce-cb1e-4f07-9510-8538f64f9914","resolution":{"observed_at":"2026-08-10T23:16:04.343231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.325372Z","title":"Integrating visuospatial, linguistic, and commonsense structure into story visualization,","venue":null,"work_id":"062f0b79-c351-4736-93cb-66176b2799e5","year":2021},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.746956Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:f3510506f025d84f1c7935587c66e01b412286d46633335ff78bd9a333c82cc1","observation_id":"fb1456cd-1221-4a99-8ac8-0f85a7d7b0d2","resolution":{"observed_at":"2026-08-10T23:16:04.329923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11340","last_updated":"2024-11-21T14:09:12Z","snapshot_observed_at":"2026-08-10T11:21:08.205918Z","submitted_at":"2024-09-17T16:42:46Z","title":"OmniGen: Unified Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11340","snapshot_observed_at":"2026-08-10T23:16:03.750839Z","title":"Omnigen: Unified image generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.750839Z"},"links":{"cited_paper":"/paper/2409.11340","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:a5ea1e3ab2b44e9b66d77e11ce719dc4446b0873a1fbcd00a292b426733d296a","observation_id":"374aac90-e955-4f9b-a17c-33a499cc47db","resolution":{"observed_at":"2026-08-10T23:16:03.750839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17082","last_updated":"2025-02-24T07:35:14Z","snapshot_observed_at":"2026-08-10T10:16:52.768995Z","submitted_at":"2024-05-27T11:55:35Z","title":"Ensembling Diffusion Models via Adaptive Feature Aggregation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17082","snapshot_observed_at":"2026-08-10T23:16:03.755285Z","title":"Ensembling diffusion models via adaptive feature aggregation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.755285Z"},"links":{"cited_paper":"/paper/2405.17082","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:7bd0b2c99073e66f928103b8f1a2fd24daddfac82941fd3b4b2f062b31a7ffbf","observation_id":"e18355b4-d03b-4ae3-9328-03ae1b0e2607","resolution":{"observed_at":"2026-08-10T23:16:03.755285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02511","last_updated":"2024-06-04T17:32:52Z","snapshot_observed_at":"2026-08-11T02:21:49.599854Z","submitted_at":"2024-06-04T17:32:52Z","title":"V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02511","snapshot_observed_at":"2026-08-10T23:16:03.759851Z","title":"V-express: Conditional dropout for progressive training of portrait video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.759851Z"},"links":{"cited_paper":"/paper/2406.02511","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:3a19a8c457d866bcd78236790c7dc0665697b528e8d702828b622eea6454cdef","observation_id":"891f91a3-c3ad-409b-b580-5b11b3d0a857","resolution":{"observed_at":"2026-08-10T23:16:03.759851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.313902Z","title":"Ic-light github page,","venue":null,"work_id":"5e29cbe8-b29b-43d1-ad10-7b019de2fb71","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.764409Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:ea1e2331f10ddd22ed0afa321d2db09b38bad7a6e813e85a31ca586862a18461","observation_id":"439e96dc-0164-4424-95bf-eb3b1531575e","resolution":{"observed_at":"2026-08-10T23:16:04.317460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.301624Z","title":"Towards efficient generative large language model serving: A survey from algorithms to systems,","venue":null,"work_id":"9ca5aca3-407d-49b9-bd91-53f578a60ec4","year":2023},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.768351Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:b88ff05662bafb4ff64ff5cc901e58910d0db8d268f13ab31a072a2abd39db33","observation_id":"06694654-6781-4e95-99fd-d163900cbb5a","resolution":{"observed_at":"2026-08-10T23:16:04.305625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.288482Z","title":"Resolving multi- condition confusion for finetuning-free personalized image generation,","venue":null,"work_id":"4858fb73-aca6-4812-b3e4-25e4cde6dfd1","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.772438Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:443edc6987bc59ac89ef1b60b96b545c05e49d39f964f5f7c28f30149ccc1ff8","observation_id":"27c195c0-75f5-426b-aeb0-3795b61a3aac","resolution":{"observed_at":"2026-08-10T23:16:04.293077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.274538Z","title":"Storymaker: Towards holistic consistent characters in text-to-image generation,","venue":null,"work_id":"a67033f1-8a05-4a03-85d4-7af791c41d6d","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.776665Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:db7b6451015f888e4f688d4f5eb47017bd19525728450a1db995185ec5926277","observation_id":"fbbb943d-23ed-4b51-b350-96c498e1412d","resolution":{"observed_at":"2026-08-10T23:16:04.278720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.261829Z","title":"Storydiffusion: Consistent self-attention for long-range image and video generation,","venue":null,"work_id":"b2cf76b7-8711-460b-8df8-7be7d8f74cb0","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.781297Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:f94b52761324c7d397622b5a473fe27bb41ac0c2fd606e58c36dd0a5ff035571","observation_id":"3d450783-be3d-4cca-a6a0-89f05ed10131","resolution":{"observed_at":"2026-08-10T23:16:04.266083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.249436Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"85ddcfdb-2030-4b35-9d01-1f3f60338738","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.785910Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:cd6c8a435018a9e6b6ae52fab95a9d607c22ac7a4c728fc54d4b3e47c71b66be","observation_id":"016f939b-6dd7-4d5d-8e75-c8f156ca3638","resolution":{"observed_at":"2026-08-10T23:16:04.253442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.237495Z","title":"Retrieval- augmented generation for knowledge-intensive nlp tasks,","venue":null,"work_id":"f2c0f06a-3d92-4f82-a0ab-9aa9fd09283e","year":2020},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.789674Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:e22941b40a53a1461e019531f787f6ca696c0ea6782f84793b5b3f34e6b170fa","observation_id":"6ba3988d-a91e-4b50-8804-6e957ee15860","resolution":{"observed_at":"2026-08-10T23:16:04.241701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.225547Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":"cd00a13f-71ea-4256-b7a2-7b5d4af574b1","year":2022},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.793550Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:76a2093846b4785a10fe19ac63daf3ba87cf0d6009573f973da12f48079a7a0f","observation_id":"9363132b-f11f-43ce-8820-f4463dbe6b87","resolution":{"observed_at":"2026-08-10T23:16:04.229898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06313","last_updated":"2024-11-21T12:06:59Z","snapshot_observed_at":"2026-08-10T12:41:22.162322Z","submitted_at":"2023-10-10T05:13:17Z","title":"Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06313","snapshot_observed_at":"2026-08-10T23:16:03.797664Z","title":"Advancing pose-guided image synthesis with progressive conditional diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.797664Z"},"links":{"cited_paper":"/paper/2310.06313","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:10eede63a1473d89780f999ff9d20eba81995116c2655c5e93510332e8c65667","observation_id":"820362cb-c77e-4b36-8616-49746a0dc710","resolution":{"observed_at":"2026-08-10T23:16:03.797664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.213466Z","title":"Exploring warping- guided features via adaptive latent diffusion model for virtual try-on,","venue":null,"work_id":"30904dbe-8f28-41e4-94bb-ad472e800ae9","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.801888Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:bcb8ca8337737e3b0a1075a9a42d2c88a8d290b543b9d4ba73a73c5d0c3f2cb3","observation_id":"8b5d59f7-9fc4-45c0-9037-138fc3b876a8","resolution":{"observed_at":"2026-08-10T23:16:04.217972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.200407Z","title":"Imagpose: A unified conditional framework for pose-guided person generation,","venue":null,"work_id":"9d1e0ee3-eb4d-40e8-9624-e52747b7a4cc","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.805693Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:20cef57369e484579ed79f1c30268c514579ca706ac89434938d00121167174b","observation_id":"6124a1ca-73b9-419a-b15c-5ec417096d09","resolution":{"observed_at":"2026-08-10T23:16:04.204745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.186633Z","title":"Mastering text-to-image diffusion: Recaptioning, planning, and generating with multimodal llms,","venue":null,"work_id":"69de9191-615a-4466-aa52-9ba48c800b74","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.809533Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:346e361115bfdc725ae3b567af95a4c5526cb5130aaf283840d71230a6c9302b","observation_id":"4b1f8d80-1cc2-4609-921f-c0d18a3a0100","resolution":{"observed_at":"2026-08-10T23:16:04.191019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12705","last_updated":"2024-08-06T13:06:26Z","snapshot_observed_at":"2026-08-09T18:34:17.959690Z","submitted_at":"2024-07-17T16:26:30Z","title":"IMAGDressing-v1: Customizable Virtual Dressing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12705","snapshot_observed_at":"2026-08-10T23:16:03.813285Z","title":"Imagdressing-v1: Customizable virtual dressing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.813285Z"},"links":{"cited_paper":"/paper/2407.12705","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:aba42a7be8aad97db9e298da889d99f20cc67e276c600217d2971266b91152d6","observation_id":"c6d01489-089a-4a3f-9574-25539fe1db5d","resolution":{"observed_at":"2026-08-10T23:16:03.813285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.172763Z","title":"Layoutgpt: Compositional visual planning and generation with large language models,","venue":null,"work_id":"44c3a84d-b38e-4698-a7ef-b87ceb19cb12","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.817507Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:396b751529963983830c1cead9f277e46dba0467aad780f06b9482c485437429","observation_id":"8c4cb2f4-ce71-46e5-9fd8-a1063092071e","resolution":{"observed_at":"2026-08-10T23:16:04.177130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.160849Z","title":"Interactive story visualization with multiple characters,","venue":null,"work_id":"8cfdc153-fe19-466f-842c-91be38a92aed","year":2023},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.821602Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:eab7cd95c34589e8bb32a514bbdcf40685b65dafaeaa3590f7c6169e8168020a","observation_id":"85e8bc47-6cf2-4a7f-bc92-199659796859","resolution":{"observed_at":"2026-08-10T23:16:04.164715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.147978Z","title":"Anim-director: A large multimodal model powered agent for control- lable animation video generation,","venue":null,"work_id":"c27d81d7-d20c-4a73-ae8e-583f232ced7e","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.825643Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:eebb4ddd0f52c4e0de07dc39a0f4d492e8cd981cb6078119d7c5a08e3ccf6828","observation_id":"60333c3d-be3b-4e5d-94bf-8588990e7059","resolution":{"observed_at":"2026-08-10T23:16:04.152495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.135736Z","title":"Synthesizing coherent story with auto-regressive latent diffusion models,","venue":null,"work_id":"6025852e-8d7b-41a4-9670-5bccbe7d9edb","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.829573Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:870bb65b6197885e0e058f9f0be608f5a20ecb9ae5596984a689e4bf2db97e98","observation_id":"31bb458e-4ac7-42a0-b9aa-f21c44b33257","resolution":{"observed_at":"2026-08-10T23:16:04.139506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02482","last_updated":"2024-07-03T18:17:01Z","snapshot_observed_at":"2026-08-11T10:38:17.860536Z","submitted_at":"2024-07-02T17:58:07Z","title":"Boosting Consistency in Story Visualization with Rich-Contextual Conditional Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02482","snapshot_observed_at":"2026-08-10T23:16:03.833466Z","title":"Boosting consistency in story visualization with rich-contextual condi- tional diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.833466Z"},"links":{"cited_paper":"/paper/2407.02482","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:746af6342b107b0523b15dd64c720344bb6fae8cfb1b6be183f51efbd24ea61e","observation_id":"c7b1917b-6bab-4fec-9662-c3cff172ae44","resolution":{"observed_at":"2026-08-10T23:16:03.833466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-10T23:16:03.837967Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.837967Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:448ff18d24e0c3b55b84b5626d1b95eb1a105729ae339d392381bcb8a141a79e","observation_id":"8a7646ea-7c84-41df-87d9-294f40ff0466","resolution":{"observed_at":"2026-08-10T23:16:03.837967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23775","last_updated":"2024-11-05T06:41:27Z","snapshot_observed_at":"2026-07-06T19:42:47.238254Z","submitted_at":"2024-10-31T09:45:00Z","title":"In-Context LoRA for Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23775","snapshot_observed_at":"2026-08-10T23:16:03.842123Z","title":"In-context lora for diffusion transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.842123Z"},"links":{"cited_paper":"/paper/2410.23775","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:fa13a9041a568d1e1b26d249584fb7340b95095ce2d56e61097e3801641581cf","observation_id":"57f2965a-10ec-4c27-acd9-67c2e1f785f9","resolution":{"observed_at":"2026-08-10T23:16:03.842123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03632","last_updated":"2024-12-04T18:48:20Z","snapshot_observed_at":"2026-08-08T15:31:21.670732Z","submitted_at":"2024-12-04T18:48:20Z","title":"MV-Adapter: Multi-view Consistent Image Generation Made Easy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03632","snapshot_observed_at":"2026-08-10T23:16:03.846971Z","title":"Mv-adapter: Multi-view consistent image generation made easy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.846971Z"},"links":{"cited_paper":"/paper/2412.03632","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:588d213ff7ba5ee0aaf69ac3592f196cd6fe22b3aeb68ddc336435ab826b63ea","observation_id":"44c7bb6f-3656-498f-826d-228f0ed0552b","resolution":{"observed_at":"2026-08-10T23:16:03.846971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.121775Z","title":"Tencent hunyuan3d-1.0: A unified framework for text-to-3d and image-to-3d generation,","venue":null,"work_id":"f79491da-2216-4b4b-b006-c1465d95e1d0","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.850889Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:911e9cf0ec4ce37bb4dd32e3068327bfcaed46ceb8ba34fc9e94f7d6e62d070e","observation_id":"6fd96cf3-5ca2-4083-a1ab-650d243f64c5","resolution":{"observed_at":"2026-08-10T23:16:04.127766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.109477Z","title":"Chatgpt (version 4),","venue":null,"work_id":"9d92c21c-1dac-4c50-bddb-3a4384beed9e","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.854212Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:f7adebc2f155990162d565eb8d3c35aa18b31201a70dd6739bff02f2ce6954f1","observation_id":"0084e240-54e1-4440-93b0-73e610e8d920","resolution":{"observed_at":"2026-08-10T23:16:04.113549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.094079Z","title":"Dream creation: Virtual 3d or e-commerce scene key visual poster or blind box ip display c4d super visual","venue":null,"work_id":"687408c0-365a-4501-b4b8-f730fe9896b2","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.858075Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:23db070c8f6b44e85dfc50749e616e2b68105cc7f60a688eb2cd076a690b070b","observation_id":"f1a1006f-6944-450a-a258-89993af58728","resolution":{"observed_at":"2026-08-10T23:16:04.099060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.080509Z","title":"Making a “completely blind","venue":null,"work_id":"437f8e05-f922-46ff-b3f0-313abded55b8","year":2013},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.861731Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:07ce28353390c792628a919a0eb76d2604c98d4acc3a60ac8cf8294e99d61c0e","observation_id":"95a8e95f-12b3-4217-bf32-dafb48f0cbaa","resolution":{"observed_at":"2026-08-10T23:16:04.084601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:03.865054Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.865054Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:554bf7a6db9c094056389fd19c5640f005babbf3510575001faca5af6a4cb61a","observation_id":"d6cc16f3-2c3d-448a-9fa1-293676843d97","resolution":{"observed_at":"2026-08-10T23:16:03.865054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.059128Z","title":"Dall·e 3: Text-to-image generation","venue":null,"work_id":"4cac8228-5ba2-4461-81f9-67ff5a20c604","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.868424Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:f6d144e36a5e77c5e9aea68c49d3480731e6872a54342ee064cf64640f2adff3","observation_id":"c796b756-97ce-414b-8f0d-f552bb9df2a5","resolution":{"observed_at":"2026-08-10T23:16:04.063582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.046085Z","title":"Before sunset","venue":null,"work_id":"6bdb1caa-f211-42f2-836b-a1cc3c09f907","year":2004},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.871829Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:d2449e32a891f6e1e8abd853bf068179cc44d83e4b921827ec8be48e4a128dea","observation_id":"55619957-9e4c-45bf-8d6a-1325237412ce","resolution":{"observed_at":"2026-08-10T23:16:04.050222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.032435Z","title":"de Saint-Exup ´ery, The Little Prince","venue":null,"work_id":"8fdb4b4b-e5b6-44b5-8a2a-eb0e6a618104","year":1943},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.875392Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:9f54e56773c79abe776502120779c660f631850691997690457670dc99eb7bbb","observation_id":"24d506b1-8940-4000-9455-e5949aa21c70","resolution":{"observed_at":"2026-08-10T23:16:04.037734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.017115Z","title":null,"venue":null,"work_id":"fada867d-c09c-4a22-99c7-d738a495220e","year":null},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.879115Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:b9e7f12508fbf139654cd1a222c9ac248da225781a604e336b4152695be3d79a","observation_id":"f3087e41-4b74-4549-a109-4b4b38b117b3","resolution":{"observed_at":"2026-08-10T23:16:04.023260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T02:22:48.214760Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":30},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2412.20725."}