{"as_of":"2026-08-08T09:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:09cb80b30a5eb604ba1c0c459104e9694a0435e4268586f90e59f140b37826be","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:43:35.795204Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:08:36.784582Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.20800","last_updated":"2024-12-30T08:47:25Z","snapshot_observed_at":"2026-07-06T20:14:31.883493Z","submitted_at":"2024-12-30T08:47:25Z","title":"VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control","version":1},"cited_work":{"arxiv_id":"2412.20800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20800","snapshot_observed_at":"2026-07-03T16:08:36.784582Z","title":"Vmix: Improving text-to-image diffusion model with cross-attention mixing control","venue":null,"work_id":"c5518023-9697-4750-aa1f-d62fa24d9050","year":2024},"citing_paper":{"arxiv_id":"2503.07703","last_updated":"2025-03-10T17:58:33Z","snapshot_observed_at":"2026-07-06T20:50:09.622181Z","submitted_at":"2025-03-10T17:58:33Z","title":"Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-17T08:27:36.242416Z"},"links":{"cited_paper":"/paper/2412.20800","citing_paper":"/paper/2503.07703"},"observation_digest":"sha256:7c18fa052599be8ac62b05bc0b0cd40fc4d2ef845c82cca34e74491cfe954304","observation_id":"031d3ef1-bce8-4299-934a-9c699feb9392","resolution":{"observed_at":"2026-05-17T08:27:36.347287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20800","last_updated":"2024-12-30T08:47:25Z","snapshot_observed_at":"2026-07-06T20:14:31.883493Z","submitted_at":"2024-12-30T08:47:25Z","title":"VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20800","snapshot_observed_at":"2026-08-07T15:43:35.795204Z","title":"Vmix: Improving text-to-image diffusion model with cross-attention mixing control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14135","last_updated":"2025-05-28T13:11:02Z","snapshot_observed_at":"2026-08-07T15:37:29.439425Z","submitted_at":"2025-05-20T09:39:48Z","title":"Hunyuan-Game: Industrial-grade Intelligent Game Creation Model","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:35.795204Z"},"links":{"cited_paper":"/paper/2412.20800","citing_paper":"/paper/2505.14135"},"observation_digest":"sha256:2e52b7f9cec103df9be556362a1e66deac4fac8d8731c3a322c4c2fa8f6aa275","observation_id":"66558f9c-122f-4364-96d7-1705e3e425ee","resolution":{"observed_at":"2026-08-07T15:43:35.795204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20800","last_updated":"2024-12-30T08:47:25Z","snapshot_observed_at":"2026-07-06T20:14:31.883493Z","submitted_at":"2024-12-30T08:47:25Z","title":"VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20800","snapshot_observed_at":"2026-08-05T16:07:24.712500Z","title":"Vmix: Improving text-to-image diffusion model with cross-attention mixing control.arXiv preprint arXiv:2412.20800, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18966","last_updated":"2025-08-26T12:10:24Z","snapshot_observed_at":"2026-08-05T16:07:23.760765Z","submitted_at":"2025-08-26T12:10:24Z","title":"USO: Unified Style and Subject-Driven Generation via Disentangled and Reward Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T16:07:24.712500Z"},"links":{"cited_paper":"/paper/2412.20800","citing_paper":"/paper/2508.18966"},"observation_digest":"sha256:27ffd92cb9c783394d3a292f76fa4b01c3055f774961e7de513048da80f93a00","observation_id":"aa3ec40c-2d58-4253-bce6-f92b281dfccb","resolution":{"observed_at":"2026-08-05T16:07:24.712500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20800","last_updated":"2024-12-30T08:47:25Z","snapshot_observed_at":"2026-07-06T20:14:31.883493Z","submitted_at":"2024-12-30T08:47:25Z","title":"VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control","version":1},"cited_work":{"arxiv_id":"2412.20800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20800","snapshot_observed_at":"2026-07-03T16:08:36.784582Z","title":"Vmix: Improving text-to-image diffusion model with cross-attention mixing control","venue":null,"work_id":"c5518023-9697-4750-aa1f-d62fa24d9050","year":2024},"citing_paper":{"arxiv_id":"2605.18678","last_updated":"2026-05-20T11:14:23Z","snapshot_observed_at":"2026-08-04T16:01:22.114748Z","submitted_at":"2026-05-18T17:18:24Z","title":"Lance: Unified Multimodal Modeling by Multi-Task Synergy","version":1},"reference_index":126,"source":"pdf_text","source_observed_at":"2026-05-20T11:46:52.658984Z"},"links":{"cited_paper":"/paper/2412.20800","citing_paper":"/paper/2605.18678"},"observation_digest":"sha256:52ae4afbf34673dca5b8acbbb97943518d77f8e5f6a8b4f637bfc595b4bdecb5","observation_id":"231858dd-4c04-402d-9551-0a4a7fdc36d3","resolution":{"observed_at":"2026-05-20T11:48:14.898019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20800","last_updated":"2024-12-30T08:47:25Z","snapshot_observed_at":"2026-07-06T20:14:31.883493Z","submitted_at":"2024-12-30T08:47:25Z","title":"VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control","version":1},"cited_work":{"arxiv_id":"2412.20800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20800","snapshot_observed_at":"2026-07-03T16:08:36.784582Z","title":"Vmix: Improving text-to-image diffusion model with cross-attention mixing control","venue":null,"work_id":"c5518023-9697-4750-aa1f-d62fa24d9050","year":2024},"citing_paper":{"arxiv_id":"2605.18678","last_updated":"2026-05-20T11:14:23Z","snapshot_observed_at":"2026-08-04T16:01:22.114748Z","submitted_at":"2026-05-18T17:18:24Z","title":"Lance: Unified Multimodal Modeling by Multi-Task Synergy","version":2},"reference_index":127,"source":"pdf_text","source_observed_at":"2026-05-21T07:56:34.034047Z"},"links":{"cited_paper":"/paper/2412.20800","citing_paper":"/paper/2605.18678"},"observation_digest":"sha256:11bd5f4b5923880fcee991452be2442b146eb0f9b9d8a37c85479b4611ad4cde","observation_id":"7f1577d7-0629-488d-bc36-be05546242f9","resolution":{"observed_at":"2026-05-21T07:59:50.615292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20800","last_updated":"2024-12-30T08:47:25Z","snapshot_observed_at":"2026-07-06T20:14:31.883493Z","submitted_at":"2024-12-30T08:47:25Z","title":"VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control","version":1},"cited_work":{"arxiv_id":"2412.20800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20800","snapshot_observed_at":"2026-07-03T16:08:36.784582Z","title":"Vmix: Improving text-to-image diffusion model with cross-attention mixing control","venue":null,"work_id":"c5518023-9697-4750-aa1f-d62fa24d9050","year":2024},"citing_paper":{"arxiv_id":"2607.02038","last_updated":"2026-07-03T06:32:47Z","snapshot_observed_at":"2026-08-02T17:42:17.276951Z","submitted_at":"2026-07-02T11:05:58Z","title":"Hierarchical Anti-Aesthetics: Protecting Facial Privacy against Customized Diffusion Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-03T16:03:53.914362Z"},"links":{"cited_paper":"/paper/2412.20800","citing_paper":"/paper/2607.02038"},"observation_digest":"sha256:56d02dae49d63d80f777f136c05e141c68274b19b71eeb83164f61a317bf226e","observation_id":"c918efdd-0c08-4a17-879a-48199593ed99","resolution":{"observed_at":"2026-07-03T16:08:36.786079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20800","last_updated":"2024-12-30T08:47:25Z","snapshot_observed_at":"2026-07-06T20:14:31.883493Z","submitted_at":"2024-12-30T08:47:25Z","title":"VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20800","snapshot_observed_at":"2026-07-12T08:29:25.498449Z","title":"Vmix: Improving text- to-image diffusion model with cross-attention mixing control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02038","last_updated":"2026-07-03T06:32:47Z","snapshot_observed_at":"2026-08-02T17:42:17.276951Z","submitted_at":"2026-07-02T11:05:58Z","title":"Hierarchical Anti-Aesthetics: Protecting Facial Privacy against Customized Diffusion Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-12T08:29:25.498449Z"},"links":{"cited_paper":"/paper/2412.20800","citing_paper":"/paper/2607.02038"},"observation_digest":"sha256:6af5a71060e9f407d278ee3b547f14ea6da16f4626095242450d43dcad1a3fe4","observation_id":"77166575-9b0b-43f8-89ff-3aad018eef03","resolution":{"observed_at":"2026-07-12T08:29:25.498449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.20800/citation-record","integrity":"/paper/2412.20800/integrity","json":"/paper/2412.20800/citation-record.json","paper":"/paper/2412.20800"},"outbound":[],"paper":{"arxiv_id":"2412.20800","last_updated":"2024-12-30T08:47:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T20:14:31.883493Z","submitted_at":"2024-12-30T08:47:25Z","title":"VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2412.20800."}