{"as_of":"2026-08-16T14:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:63aa7c3f7b6d7d38deaf1508a94eceaa956feb6932102669c708daaefd23ea5b","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:47:33.072759Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18900/citation-record","integrity":"/paper/2506.18900/integrity","json":"/paper/2506.18900/citation-record.json","paper":"/paper/2506.18900"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T18:47:32.903548Z","title":"arXiv preprint arXiv:2303.08774 (2023) 5","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.903548Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:57894a5aa7e69811b3d34e9b0223d3ce0325f67cb9ba7f7e1bd4fbf508d6b7fc","observation_id":"a7aa011e-60a4-41bd-b031-e2e00482042d","resolution":{"observed_at":"2026-08-15T18:47:32.903548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.662313Z","title":null,"venue":null,"work_id":"e0b804ca-c3a3-444c-97ca-259efb53bd9c","year":2020},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.908808Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:7d6b633bb1e0ffcdd0cd50b37897b3f7dc29fd10becea9c58643e4137e47a2b4","observation_id":"b89de86a-2371-4707-9f35-d50f3e5688ee","resolution":{"observed_at":"2026-08-15T18:47:33.667271Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18616","last_updated":"2024-11-27T18:58:52Z","snapshot_observed_at":"2026-08-16T04:39:49.435309Z","submitted_at":"2024-11-27T18:58:52Z","title":"Diffusion Self-Distillation for Zero-Shot Customized Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18616","snapshot_observed_at":"2026-08-15T18:47:32.913593Z","title":"org/abs/2411.186161, 3, 5, 6, 13","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.913593Z"},"links":{"cited_paper":"/paper/2411.18616","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:65906efa612442c0e53e8dbc6129b067d5aa84d20dee3a1a0725f3989acb695e","observation_id":"5865e64e-8214-4b45-9ce8-0a9e55754f52","resolution":{"observed_at":"2026-08-15T18:47:32.913593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.648227Z","title":"In: Proceedings of the International Conference on Computer Vision (ICCV) (2021) 6","venue":null,"work_id":"bae78161-be1b-4155-91c5-b873d6298ee7","year":2021},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.918100Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:bdf3a68bdd50a1453fd58782b1c6ce3b52c47df7bee66a8c5b43e913db72ca79","observation_id":"35177ea5-304f-45fc-899d-54627009760d","resolution":{"observed_at":"2026-08-15T18:47:33.653055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01388","last_updated":"2025-05-30T13:55:44Z","snapshot_observed_at":"2026-08-16T13:46:42.642014Z","submitted_at":"2024-06-03T14:51:24Z","title":"AutoStudio: Crafting Consistent Subjects in Multi-turn Interactive Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01388","snapshot_observed_at":"2026-08-15T18:47:32.922478Z","title":"arXiv preprint arXiv:2406.01388 (2024) 2, 5, 6, 13","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.922478Z"},"links":{"cited_paper":"/paper/2406.01388","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:8c853c158ab3f07cdbeadb563b8e60dd2ba8bedd17b1cc678cc93b152f68704d","observation_id":"543b827c-15a7-4f96-96f4-2c58c8d4c094","resolution":{"observed_at":"2026-08-15T18:47:32.922478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10605","last_updated":"2024-12-16T02:08:29Z","snapshot_observed_at":"2026-08-16T13:25:18.649168Z","submitted_at":"2024-08-20T07:37:23Z","title":"MUSES: 3D-Controllable Image Generation via Multi-Modal Agent Collaboration","version":5},"cited_work":{"arxiv_id":"2408.10605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.10605","snapshot_observed_at":"2026-08-15T18:47:33.442478Z","title":"MUSES: 3D-Controllable Image Generation via Multi-Modal Agent Collaboration","venue":"cs.CV","work_id":"03d8ba38-3099-4037-893f-454c441eea82","year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.926720Z"},"links":{"cited_paper":"/paper/2408.10605","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:5deeba80f49466ee3920c3fdc90968f3364d5db9fded296e9f4bf04e58235632","observation_id":"5dbf1aec-f5a4-496e-b768-16ac9d825a25","resolution":{"observed_at":"2026-08-15T18:47:33.449122Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18247","last_updated":"2023-05-30T08:54:42Z","snapshot_observed_at":"2026-08-16T04:39:48.811473Z","submitted_at":"2023-05-29T17:11:39Z","title":"TaleCrafter: Interactive Story Visualization with Multiple Characters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18247","snapshot_observed_at":"2026-08-15T18:47:32.931250Z","title":"arXiv preprint arXiv:2305.18247 (2023) 2","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.931250Z"},"links":{"cited_paper":"/paper/2305.18247","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:57f9a7cbe97355dff2849544172f6494dfc0c33502f49ca90a788b584cc83e70","observation_id":"2e165cda-91cc-43b7-9e4a-a0f984f50328","resolution":{"observed_at":"2026-08-15T18:47:32.931250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.634468Z","title":"Communications of the ACM63(11), 139–144 (2020) 2","venue":null,"work_id":"9a1c91ac-ad1d-48c6-8509-81d765a21d34","year":2020},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.935201Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:da4d6ed3ff3aab2418ad6b297f904b8db1a3573f0c0871f8ea1786273fc43f2f","observation_id":"0935e689-0cae-410b-b0d9-2a7485919984","resolution":{"observed_at":"2026-08-15T18:47:33.638826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-15T18:47:32.938926Z","title":"arXiv preprint arXiv:2106.09685 (2021) 2","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.938926Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:4a35869b0fb1f2b50fbf389d658e35189ff200648d8d7e1ff6f7e20d7f690776","observation_id":"b61e3228-03c4-47d5-8b44-a6a25a95f002","resolution":{"observed_at":"2026-08-15T18:47:32.938926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04925","last_updated":"2024-11-11T13:24:18Z","snapshot_observed_at":"2026-08-16T13:02:01.573262Z","submitted_at":"2024-11-07T18:00:33Z","title":"StoryAgent: Customized Storytelling Video Generation via Multi-Agent Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04925","snapshot_observed_at":"2026-08-15T18:47:32.943482Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.943482Z"},"links":{"cited_paper":"/paper/2411.04925","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:413c3a94b4eed283094d68ee0dfb7bc278999440d8c797839b797bb74105b53a","observation_id":"8e0cebbe-4e3d-49dd-9fbb-bd465819fa0e","resolution":{"observed_at":"2026-08-15T18:47:32.943482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-08-13T12:19:54.379421Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-15T18:47:32.947904Z","title":"arXiv preprint arXiv:2303.11897 (2023) 7, 8","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.947904Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:212a1d3535f658f84b400868edeb14edb422dd676e04e6c3958bc073f8d7a84c","observation_id":"f0bc7fa2-ab92-42b3-8734-66d2cc1803e0","resolution":{"observed_at":"2026-08-15T18:47:32.947904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12359","last_updated":"2022-02-23T18:34:45Z","snapshot_observed_at":"2026-08-16T04:39:49.649179Z","submitted_at":"2022-02-23T18:34:45Z","title":"UnifiedQA-v2: Stronger Generalization via Broader Cross-Format Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12359","snapshot_observed_at":"2026-08-15T18:47:32.952289Z","title":"arXiv preprint arXiv:2202.12359 (2022) 8","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.952289Z"},"links":{"cited_paper":"/paper/2202.12359","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:09a3a6ea78500b5d0476969edd7e90941f4d7a4f71fe11432e155b206e95c392","observation_id":"e9ccacbf-04bc-4cf6-8ccd-78d431768bdb","resolution":{"observed_at":"2026-08-15T18:47:32.952289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-15T18:47:32.956547Z","title":"arXiv:2304.02643 (2023) 7, 13","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.956547Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:e966ac594bfb9048cf258ec4d080f996fa679f07c05157890b65c6431d839712","observation_id":"a2bd8532-496d-45fc-8c31-aa88a8b6fa52","resolution":{"observed_at":"2026-08-15T18:47:32.956547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.620022Z","title":"https://github.com/black- forest-labs/flux(2024) 2, 4, 5","venue":null,"work_id":"325a423e-c44b-40b0-a79f-10b0711e3037","year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.961044Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:e7440fe6fd7ec1d647fddf61164d42e2b2a98dbcdb49eea1f1ce73af9e656fb0","observation_id":"c489bbff-e176-4ae9-8cc5-a5ac1b1e7d95","resolution":{"observed_at":"2026-08-15T18:47:33.624583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15115","last_updated":"2026-04-20T17:59:36Z","snapshot_observed_at":"2026-08-02T10:06:23.710148Z","submitted_at":"2024-11-22T18:31:47Z","title":"Self-Correcting Text-to-Video Generation with Misalignment Detection and Localized Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15115","snapshot_observed_at":"2026-08-15T18:47:32.965181Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.965181Z"},"links":{"cited_paper":"/paper/2411.15115","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:172543f7e11bc3099319a34e7ef4c72e4f87af97a543882f2a3043d4f9a32528","observation_id":"63c9f851-e069-4a27-bdb6-3d177011bbdf","resolution":{"observed_at":"2026-08-15T18:47:32.965181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02784","last_updated":"2019-04-18T04:59:05Z","snapshot_observed_at":"2026-08-14T17:47:16.734429Z","submitted_at":"2018-12-06T20:10:23Z","title":"StoryGAN: A Sequential Conditional GAN for Story Visualization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02784","snapshot_observed_at":"2026-08-15T18:47:32.969508Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.969508Z"},"links":{"cited_paper":"/paper/1812.02784","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:9a63c29bb9be28ac96f2d0985d04c5559ab26f5ea01ab9f0dcbdb0f10a5fbfcd","observation_id":"aadf8234-31b7-4a50-9fb4-e6c61a4df0ac","resolution":{"observed_at":"2026-08-15T18:47:32.969508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.606162Z","title":"In: The IEEE/CVF Con- ference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":"8aa0191c-1693-4ae9-a961-7bf8567ac896","year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.973848Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:158ad5a5573aef2f1f8d3cf15808b98acbf4b605c4622da8d686868f909129f9","observation_id":"c776db3c-a80d-496f-9799-99c6555ec296","resolution":{"observed_at":"2026-08-15T18:47:33.610540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13554","last_updated":"2025-02-05T10:32:22Z","snapshot_observed_at":"2026-08-14T07:08:54.928684Z","submitted_at":"2025-01-23T10:57:22Z","title":"One-Prompt-One-Story: Free-Lunch Consistent Text-to-Image Generation Using a Single Prompt","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13554","snapshot_observed_at":"2026-08-15T18:47:32.977965Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.977965Z"},"links":{"cited_paper":"/paper/2501.13554","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:3abb968ce5247f41031105b3f71341a88b4d51e5fa997a2f5e693bcc8b32b57f","observation_id":"8117006b-a785-4314-aaad-6afbf6662d91","resolution":{"observed_at":"2026-08-15T18:47:32.977965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-08-12T13:30:30.615172Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-08-15T18:47:32.982505Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.982505Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:b3c29cffead75e5a8d2651ef4eb1e1f7ce1392474a809f6ac70bba4470e42300","observation_id":"8d830846-59f6-472d-9777-f0ab2d7c230e","resolution":{"observed_at":"2026-08-15T18:47:32.982505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:32.986819Z","title":"Biochemia medica : ˇcasopis Hrvatskoga društva medicinskih biokemi ˇcara / HDMB22, 276–82 (10 2012)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.986819Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:c30ae169211816e4f24a0a1d2bf03b5b8594d7519f7cdbf1b58ceed18c35f60c","observation_id":"8a7ba82d-1386-48ad-a478-d5f14c9a7d73","resolution":{"observed_at":"2026-08-15T18:47:32.986819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.592454Z","title":"In: Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision","venue":null,"work_id":"55dbb2c2-19e4-4f0b-8878-c55b2451564c","year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.990966Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:62d10e22c732370430df81630200c07f3427f7848b6724c13a5db55c6c14b6f3","observation_id":"66aca7d6-e222-415b-871a-609ef3144cd1","resolution":{"observed_at":"2026-08-15T18:47:33.596608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.577271Z","title":null,"venue":null,"work_id":"2c30ca25-028c-4a4b-a76b-10c1d9ec8359","year":2021},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.995230Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:a383a14af3359ddc1997437bab7f9d344d2c9488f01fe2add3d82bc2dc9b3471","observation_id":"25eb67be-40ed-4408-9b33-ad0a59161f8f","resolution":{"observed_at":"2026-08-15T18:47:33.582179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.561847Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"a8dd962f-6827-4fb7-8a57-7117b15526a8","year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:32.999623Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:09664ba247f629474edd03583069efcf4cdc348d26ab9424190daea35cdbb1ee","observation_id":"880c630b-d990-4a0b-a4e8-d2a0cd98ae15","resolution":{"observed_at":"2026-08-15T18:47:33.566687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-15T18:47:33.003691Z","title":"arXiv preprint arXiv:2204.06125 (2022) 2","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.003691Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:b7636aa26e00b132cd9db83382aa91b994a8800379b3ddbb3823a813273c7088","observation_id":"24405de2-d073-43bf-bee5-3d0fa8bbd384","resolution":{"observed_at":"2026-08-15T18:47:33.003691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.547038Z","title":null,"venue":null,"work_id":"7f955c97-c4f3-4105-9773-1b5ec572acd8","year":2021},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.007958Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:bffcb82226896b18766f0498230f765716ca30662488a32010fc7444d567f02f","observation_id":"dfb17976-563d-4c9e-9249-6238db2e52e0","resolution":{"observed_at":"2026-08-15T18:47:33.551443Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-08-12T12:48:35.419134Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11487","snapshot_observed_at":"2026-08-15T18:47:33.012070Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.012070Z"},"links":{"cited_paper":"/paper/2205.11487","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:4657a4dbdd36659c129520b6886c9f9a62621af018a09d01b57a91bd28efc481","observation_id":"3cd9eae1-88b3-443b-b653-c06203f8ca69","resolution":{"observed_at":"2026-08-15T18:47:33.012070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17580","last_updated":"2023-12-03T18:17:21Z","snapshot_observed_at":"2026-08-12T12:50:51.005571Z","submitted_at":"2023-03-30T17:48:28Z","title":"HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17580","snapshot_observed_at":"2026-08-15T18:47:33.016629Z","title":"org/abs/2303.175803","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.016629Z"},"links":{"cited_paper":"/paper/2303.17580","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:04d47acead102007bf204c08f0fa6f768cdfcf446800f5a160200e48d41bbe01","observation_id":"7f4e2d6b-6d32-40f2-8bc5-3df53d5a0272","resolution":{"observed_at":"2026-08-15T18:47:33.016629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05979","last_updated":"2024-04-09T03:22:36Z","snapshot_observed_at":"2026-08-16T14:02:32.904988Z","submitted_at":"2024-04-09T03:22:36Z","title":"StoryImager: A Unified and Efficient Framework for Coherent Story Visualization and Completion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05979","snapshot_observed_at":"2026-08-15T18:47:33.020307Z","title":"arXiv preprint arXiv:2404.05979 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.020307Z"},"links":{"cited_paper":"/paper/2404.05979","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:5ae2ea7dfe523d4ff02faf7f15bdf20ce3cf7180442136fbcc6991cc173ecad9","observation_id":"5e49442b-5df3-42a1-9bfe-de55b7f735f0","resolution":{"observed_at":"2026-08-15T18:47:33.020307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03286","last_updated":"2024-05-30T11:42:15Z","snapshot_observed_at":"2026-08-16T14:21:18.341809Z","submitted_at":"2024-02-05T18:42:34Z","title":"Training-Free Consistent Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03286","snapshot_observed_at":"2026-08-15T18:47:33.024240Z","title":"org/abs/2402.032862, 5, 6, 8, 13","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.024240Z"},"links":{"cited_paper":"/paper/2402.03286","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:14276f782516e640e1030b775707270c37e10ba8e63958d821f6ef4596716cfc","observation_id":"18f3ec87-df07-4dc1-826f-c5bba7d45a63","resolution":{"observed_at":"2026-08-15T18:47:33.024240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11243","last_updated":"2023-11-19T06:07:37Z","snapshot_observed_at":"2026-08-13T05:22:30.574677Z","submitted_at":"2023-11-19T06:07:37Z","title":"AutoStory: Generating Diverse Storytelling Images with Minimal Human Effort","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11243","snapshot_observed_at":"2026-08-15T18:47:33.029390Z","title":"arXiv preprint arXiv:2311.11243 (2023) 2","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.029390Z"},"links":{"cited_paper":"/paper/2311.11243","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:9ee1e55e399227e5babfffb85cfcb17552624251c680a5b4f29f2597e0aeb20c","observation_id":"6fdf4f61-ebe1-4140-8a1d-e1c768795b88","resolution":{"observed_at":"2026-08-15T18:47:33.029390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05600","last_updated":"2024-10-28T14:08:13Z","snapshot_observed_at":"2026-08-16T13:36:19.464063Z","submitted_at":"2024-07-08T04:30:53Z","title":"GenArtist: Multimodal LLM as an Agent for Unified Image Generation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05600","snapshot_observed_at":"2026-08-15T18:47:33.033680Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.033680Z"},"links":{"cited_paper":"/paper/2407.05600","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:5014a1e2b3152861da24554665ac5d31b3e84105921b993ad6a95f3ab3c7e81e","observation_id":"f36f8f43-6527-4c77-84a8-a437dbf71bc1","resolution":{"observed_at":"2026-08-15T18:47:33.033680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-08-15T10:03:23.497428Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-15T18:47:33.037643Z","title":"org/abs/2303.046713","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.037643Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:e49e6fed144bb0a165dc3dafe413bc625615f83e2a8ce7f3add69a9e5c85bccf","observation_id":"978e3094-5901-44c8-86e7-86da20026f0b","resolution":{"observed_at":"2026-08-15T18:47:33.037643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-15T18:47:33.041919Z","title":"arXiv preprint arXiv:2308.08155 (2023) 5","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.041919Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:caa7db0f823119fb885d57ed788cbfc14f933ec2a13e1d8602b88c32aee11a49","observation_id":"8a1de43c-1b91-41ba-8f3a-81d76fc53838","resolution":{"observed_at":"2026-08-15T18:47:33.041919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16090","last_updated":"2023-11-27T18:56:37Z","snapshot_observed_at":"2026-08-16T14:39:55.872897Z","submitted_at":"2023-11-27T18:56:37Z","title":"Self-correcting LLM-controlled Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16090","snapshot_observed_at":"2026-08-15T18:47:33.046271Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.046271Z"},"links":{"cited_paper":"/paper/2311.16090","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:c91f4f9730b91bfd6a1a13f224137224e453562bda225502257184330bd211f5","observation_id":"8313d28e-3eb4-4330-8ed6-d2e58c92bf01","resolution":{"observed_at":"2026-08-15T18:47:33.046271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.533260Z","title":"093417, 8","venue":null,"work_id":"b8b43026-5d16-4bbe-8ee0-b16a0d84f1f9","year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.050962Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:a7b1bb1ba9bedb46202531232878a70e51327d3602f023ccae28f8774749a37b","observation_id":"49a1f92a-ffc3-46f9-a001-ae33986a7998","resolution":{"observed_at":"2026-08-15T18:47:33.537519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05242","last_updated":"2025-03-07T08:53:10Z","snapshot_observed_at":"2026-08-16T12:52:14.965498Z","submitted_at":"2025-03-07T08:53:10Z","title":"MM-StoryAgent: Immersive Narrated Storybook Video Generation with a Multi-Agent Paradigm across Text, Image and Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05242","snapshot_observed_at":"2026-08-15T18:47:33.055217Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.055217Z"},"links":{"cited_paper":"/paper/2503.05242","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:bcb4ed7e6e173f431e8735127cb10eb67c8c7a2aa7fee93e89cecd411e342854","observation_id":"aa4be8ef-c399-4e1d-905f-8df61745c5ab","resolution":{"observed_at":"2026-08-15T18:47:33.055217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-15T18:47:33.059856Z","title":"arXiv preprint arXiv:2407.08683 (2024), https://arxiv.org/ abs/2407.086832","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.059856Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:d74a371b1637571a8dd95cf2bf8e43ab72b7e4029a345fe05f45bc669355b0bb","observation_id":"32a27c34-22c9-4719-b64f-79592ae3d8ca","resolution":{"observed_at":"2026-08-15T18:47:33.059856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.518267Z","title":null,"venue":null,"work_id":"70f7337b-0475-467c-beeb-09997bcba3c7","year":2023},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.064272Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:c70ff165e8a4b7c251d3ba8fd4dfe08ce5131c70365a2ec31040e70b519fc466","observation_id":"cec28ee1-2005-4a89-ac1f-d715f5baba41","resolution":{"observed_at":"2026-08-15T18:47:33.523469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:47:33.504345Z","title":"In: CVPR (2018) 6","venue":null,"work_id":"1dd317f4-e7a4-42ba-bb49-35eb3c903506","year":2018},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.068561Z"},"links":{"citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:d9ffa1c9a7fa18735b0ca801717f686a36bcdaa9e68c0fb3fa4dbeda807ea8ea","observation_id":"93f2935a-d7e3-4190-ac4b-823abe2b8000","resolution":{"observed_at":"2026-08-15T18:47:33.508476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01434","last_updated":"2024-05-02T16:25:16Z","snapshot_observed_at":"2026-08-16T13:55:54.505498Z","submitted_at":"2024-05-02T16:25:16Z","title":"StoryDiffusion: Consistent Self-Attention for Long-Range Image and Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01434","snapshot_observed_at":"2026-08-15T18:47:33.072759Z","title":"A girl and her brave hamster must work together to find their way out of a tricky maze","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.072759Z"},"links":{"cited_paper":"/paper/2405.01434","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:6d560ae75096cc664fdd18187890b4a8049b206eba20952261ada898ac6a3eed","observation_id":"c568a008-cdd7-4493-b6f2-cbd3c77b36cc","resolution":{"observed_at":"2026-08-15T18:47:33.072759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T04:37:29.301743Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2506.18900."}