{"as_of":"2026-08-08T18:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d97d71cf7de6b3b548ea253ab80048e84051785bd751e0b83a2d6c82919c9e0d","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:18:27.747207Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T16:57:09.843691Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T17:00:24.083090Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"cited_work":{"arxiv_id":"2506.05843","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05843","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fontadapter: Instant font adaptation in visual text generation","venue":null,"work_id":"df0fd119-0c32-4769-8607-bc47e86ba4ce","year":2025},"citing_paper":{"arxiv_id":"2601.01593","last_updated":"2026-05-18T03:12:58Z","snapshot_observed_at":"2026-07-06T22:40:41.626783Z","submitted_at":"2026-01-04T16:46:13Z","title":"Beyond Patches: Global-aware Autoregressive Model for Multimodal Few-Shot Font Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-21T16:57:09.843691Z"},"links":{"cited_paper":"/paper/2506.05843","citing_paper":"/paper/2601.01593"},"observation_digest":"sha256:1d14212b8605614a5d92a51135c9039c5372695f3d6f23dae4b9c6cc2ad568d2","observation_id":"5d1ce551-f27e-4e6a-ac7b-7e75999575ba","resolution":{"observed_at":"2026-05-21T17:00:24.085772Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05843/citation-record","integrity":"/paper/2506.05843/integrity","json":"/paper/2506.05843/citation-record.json","paper":"/paper/2506.05843"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:22.895037Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:22.895037Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:5e3ca3791dd8d92c5670b34581d2b6aa735d8fb11f4c13df128f3e52eebd5fd6","observation_id":"cf407b36-e325-436d-8e31-ce3d5e7043e0","resolution":{"observed_at":"2026-08-07T10:18:22.895037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:22.946829Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:22.946829Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:4a9558f4c1e64633d4c832325d888746022535b702aec0aadc5d0e3977aef3ba","observation_id":"7ba84408-ff23-444f-8ebe-53431e72e9fb","resolution":{"observed_at":"2026-08-07T10:18:22.946829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T10:18:23.032839Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.032839Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:5a2eef1cee7c2f48a98e227e0acf3650f5031d4cd6393e449f897713cbd3cd1c","observation_id":"b222d6b9-78a7-4048-a0fa-a302411a826a","resolution":{"observed_at":"2026-08-07T10:18:23.032839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:23.097134Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.097134Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:e06b6ec87273b67914328cc429386321e754b3a2d94aa543420a6e3bb89e94cb","observation_id":"566d6ef1-08e4-4374-a79c-67d735089bc3","resolution":{"observed_at":"2026-08-07T10:18:23.097134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:32.834521Z","title":null,"venue":null,"work_id":"b0af06a3-d7df-4baf-b904-56e15be480c4","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.152284Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:238006ac329506347133e789a87ef932ca226a212b9afb01f784bcba9eef7cfc","observation_id":"f8591035-8c74-4c96-a3ca-2a4fcec2003c","resolution":{"observed_at":"2026-08-07T10:18:32.967139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:32.507306Z","title":"Anydoor: Zero-shot object-level image customization","venue":null,"work_id":"6020bed2-80d4-4c4b-baf9-d1a97e91796f","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.269668Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:ca0021a8f579354a21d1b3ef19a89147036baf79406fb455ebe52647715f1697","observation_id":"fe72c5d3-c70f-464c-8927-6b2cec1cbe22","resolution":{"observed_at":"2026-08-07T10:18:32.647406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05139","last_updated":"2024-07-29T09:15:33Z","snapshot_observed_at":"2026-07-06T17:41:27.341898Z","submitted_at":"2024-03-08T08:12:18Z","title":"Improving Diffusion Models for Authentic Virtual Try-on in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05139","snapshot_observed_at":"2026-08-07T10:18:23.326129Z","title":"Improving diffusion models for virtual try-on","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.326129Z"},"links":{"cited_paper":"/paper/2403.05139","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:4bec7e854b996887ddf7bc413362be4f1154ba39510e9c53ef84da62c0b12af0","observation_id":"2b357bff-da75-4e72-b332-0e986f6b3be0","resolution":{"observed_at":"2026-08-07T10:18:23.326129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:32.264092Z","title":"Deepfloyd if","venue":null,"work_id":"82fafbd6-b341-4172-8bd8-e3b6cd108f41","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.405012Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:53baf93fa1cc6d0f0c2474cd613cceefd257753573786e88f0eab89fba437380","observation_id":"65a3cd1a-ab3e-4368-8072-2f889f28768b","resolution":{"observed_at":"2026-08-07T10:18:32.349099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:23.523394Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.523394Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:eea05b4a67f8637dc5a4d2c97314316db58b88338cb7f14f7c1c4589f9959548","observation_id":"4b4d9077-2e1b-487c-aa87-cbf80bbe14a8","resolution":{"observed_at":"2026-08-07T10:18:23.523394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:31.979516Z","title":"Neural transformation fields for arbitrary-styled font generation","venue":null,"work_id":"690e91e8-a346-4be3-96be-c05c937d257e","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.629289Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:cda33e46b752e1c8190b34dc7ef6cef831c00f12502420d4709f3fa60924ea77","observation_id":"3afc96ee-9d9c-48c5-8d9d-bd7b985cc59f","resolution":{"observed_at":"2026-08-07T10:18:32.117832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:31.761854Z","title":"Generate like experts: Multi-stage font generation by incorporating font transfer process into diffusion models","venue":null,"work_id":"c43aef58-5a07-4fad-97f7-6677f2458157","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.757232Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:86776a72806c8cceac491a5b5a709dd43146171d8422a5cb804e4400c23b0611","observation_id":"39087e48-1123-48fb-a956-7ea0f7d3159d","resolution":{"observed_at":"2026-08-07T10:18:31.864092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03620","last_updated":"2024-04-04T17:43:06Z","snapshot_observed_at":"2026-08-01T21:48:30.999365Z","submitted_at":"2024-04-04T17:43:06Z","title":"LCM-Lookahead for Encoder-based Text-to-Image Personalization","version":1},"cited_work":{"arxiv_id":"2404.03620","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.03620","snapshot_observed_at":"2026-08-07T10:18:28.078422Z","title":"LCM-Lookahead for Encoder-based Text-to-Image Personalization","venue":"cs.CV","work_id":"0b9437c3-f9d4-4385-9632-0ba3c9cefb8d","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.877606Z"},"links":{"cited_paper":"/paper/2404.03620","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:40b7714d20a92f8046760226c22d975a5d9b5e79165f434f7e0210afdd941a67","observation_id":"0cf21ab7-7185-4582-95cd-e850854db39b","resolution":{"observed_at":"2026-08-07T10:18:28.224899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:31.468945Z","title":"Diff-font: Diffusion model for robust one-shot font generation","venue":null,"work_id":"4424be6f-a450-47eb-b835-3bbba5250ed3","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.922688Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:838025bb443c7e4f3a4e14b5a1d732e75df82abf03b06e8675c78528cbd55be8","observation_id":"167e1e46-e68b-4c35-bbbc-214e3b95734f","resolution":{"observed_at":"2026-08-07T10:18:31.602955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:31.221643Z","title":"Disenvisioner: Disentangled and enriched visual prompt for customized image generation","venue":null,"work_id":"080bc40e-3dfe-4cb4-9dd8-503cf2fba5fe","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.973799Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:5f754b44bef6401543f27b8a3592013cde3f7ee14749c3d51348bc0c07e152f3","observation_id":"afa786c7-3df6-41d8-a168-d1659182af3b","resolution":{"observed_at":"2026-08-07T10:18:31.357441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13346","last_updated":"2024-09-20T09:21:49Z","snapshot_observed_at":"2026-08-07T23:11:29.374808Z","submitted_at":"2024-09-20T09:21:49Z","title":"Imagine yourself: Tuning-Free Personalized Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13346","snapshot_observed_at":"2026-08-07T10:18:24.053178Z","title":"Imagine yourself: Tuning-free personalized image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.053178Z"},"links":{"cited_paper":"/paper/2409.13346","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:2b49cc1a6ab75ecaecb144dec0d460567d04cb42ca0c2edb775d1aa57ecf1244","observation_id":"be7b4418-3181-44fe-a68d-4de1e6a5efbf","resolution":{"observed_at":"2026-08-07T10:18:24.053178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T10:18:24.168081Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.168081Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:a21b429794870260c0ddff5cf62ac406b4156fe3da98e666df0832149fc1be4f","observation_id":"9bb37b66-919b-4d69-9772-8ffb81c976ec","resolution":{"observed_at":"2026-08-07T10:18:24.168081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05568","last_updated":"2023-04-12T02:08:34Z","snapshot_observed_at":"2026-08-05T11:31:30.187976Z","submitted_at":"2023-04-12T02:08:34Z","title":"Improving Diffusion Models for Scene Text Editing with Dual Encoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05568","snapshot_observed_at":"2026-08-07T10:18:24.266308Z","title":"Improving diffusion models for scene text editing with dual encoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.266308Z"},"links":{"cited_paper":"/paper/2304.05568","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:d8317e09339fc441d064f5d1ea2f67910e890d8ff7fb568bfd137889b88eb9aa","observation_id":"cdc8acb7-219c-44d4-b6c8-7f7c196d05d0","resolution":{"observed_at":"2026-08-07T10:18:24.266308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.03001","last_updated":"2022-06-14T12:00:10Z","snapshot_observed_at":"2026-07-06T13:18:06.376608Z","submitted_at":"2022-06-07T04:33:50Z","title":"PP-OCRv3: More Attempts for the Improvement of Ultra Lightweight OCR System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.03001","snapshot_observed_at":"2026-08-07T10:18:24.400336Z","title":"Pp-ocrv3: More attempts for the improvement of ultra lightweight ocr system","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.400336Z"},"links":{"cited_paper":"/paper/2206.03001","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:9bd30b4cb9d7adfd5102f6be305f457a75f7e90b5cf60760b199992a8b109152","observation_id":"f9092ba9-33e4-46f3-a576-7a8304861b78","resolution":{"observed_at":"2026-08-07T10:18:24.400336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:24.517921Z","title":"Blip-diffusion: Pre-trained subject representation for controllable text-to-image generation and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.517921Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:072f5f5a602aab2b302df19d14ed47ee6c770ffed51738b25072abb191cc1107","observation_id":"3e7185a3-8f7f-4260-b7cc-9015edb323af","resolution":{"observed_at":"2026-08-07T10:18:24.517921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-07T10:18:24.638822Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.638822Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:1bd9af8d5fc60db00880e86678f80b29c4f1f802043de840ff7bff93beb68ef0","observation_id":"5f964f43-7fe7-42aa-8076-b1d6fae8a33e","resolution":{"observed_at":"2026-08-07T10:18:24.638822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10208","last_updated":"2024-07-12T16:26:40Z","snapshot_observed_at":"2026-08-08T01:13:28.144737Z","submitted_at":"2024-06-14T17:44:09Z","title":"Glyph-ByT5-v2: A Strong Aesthetic Baseline for Accurate Multilingual Visual Text Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10208","snapshot_observed_at":"2026-08-07T10:18:24.793669Z","title":"Glyph-byt5-v2: a strong aesthetic baseline for accurate multilingual visual text rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.793669Z"},"links":{"cited_paper":"/paper/2406.10208","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:d55854e0def227e09a2a174a5dd4e1b7eaa6a0ed4f22c1875ea992549bf888c1","observation_id":"bdf97b66-2c0e-47c4-a980-e48bc7fdf0b0","resolution":{"observed_at":"2026-08-07T10:18:24.793669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:30.947133Z","title":"Glyph-byt5: A customized text encoder for accurate visual text rendering","venue":null,"work_id":"d59bd140-aa9a-45a8-9a0d-7e4c41ac02f0","year":2025},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.900979Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:9210023e0d50ca314b43590047f0953f17fbac47321aaa36517bf27610092e22","observation_id":"d61bb771-a85f-414e-99ea-5141ba949ba6","resolution":{"observed_at":"2026-08-07T10:18:31.053286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-08T06:35:17.078531Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-07T10:18:24.999496Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.999496Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:4adbaa339d673d6b0e08531941d4328a5ff1ef3d9e8d3d2e9fd59faa49d6f805","observation_id":"9c034c2a-9a01-4d91-b47a-f10ca562d8e2","resolution":{"observed_at":"2026-08-07T10:18:24.999496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:30.720368Z","title":"Dall-e 3: Text-to-image generation model","venue":null,"work_id":"00501e41-8e1a-4d99-8881-e842cfce9f3d","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.099590Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:db6f3b14f5914493c1f3e5054d32deef18b3bea084f6a313e3df194a1a5f00bc","observation_id":"652e8b1d-fa50-401b-b033-a23badd5592e","resolution":{"observed_at":"2026-08-07T10:18:30.817747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:30.471814Z","title":"Gpt-4o system card","venue":null,"work_id":"86426aad-4b05-4819-a43d-1263fba84f06","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.195624Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:70de602d609a1ca77c7ca6a59c77508187c40c941fd7737eda41dee0025bf098","observation_id":"0ce709bb-724c-4621-913d-3470cae8f4bb","resolution":{"observed_at":"2026-08-07T10:18:30.600364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:30.193478Z","title":"Few shot font generation via transferring similarity guided global style and quantization local style","venue":null,"work_id":"7421b79e-042e-4b82-a7d0-7318f91ad63b","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.332020Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:60d8fc9f3e00ab0827a075ebfd2a7432500c3b491b76447b541d5dba37964dd1","observation_id":"39a672e2-6492-45ff-982b-af2ca167cb73","resolution":{"observed_at":"2026-08-07T10:18:30.273828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:25.427823Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.427823Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:77adff520fcec064276de0814445af64b23a5f40054276977648f26cd226820f","observation_id":"18df5ed4-64c2-498b-8182-77abaa28a9fd","resolution":{"observed_at":"2026-08-07T10:18:25.427823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:25.578209Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.578209Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:9dc2dc91b62144cc5e93fc3b98ab86add7355f42c7825823d445581afe4d1f2a","observation_id":"6758f2d9-115f-4efd-8098-bef23d06f033","resolution":{"observed_at":"2026-08-07T10:18:25.578209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03209","last_updated":"2024-08-27T12:39:18Z","snapshot_observed_at":"2026-07-06T18:57:31.323769Z","submitted_at":"2024-08-06T14:08:22Z","title":"IPAdapter-Instruct: Resolving Ambiguity in Image-based Conditioning using Instruct Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03209","snapshot_observed_at":"2026-08-07T10:18:25.705669Z","title":"Ipadapter-instruct: Resolving ambiguity in image-based conditioning using instruct prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.705669Z"},"links":{"cited_paper":"/paper/2408.03209","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:819a650ec45bcc07157ba9a2260a731ec27d3ad85783091ca5ffd52bebee5cc3","observation_id":"0aff2bb7-0a4f-445f-a793-460bfc19a5fa","resolution":{"observed_at":"2026-08-07T10:18:25.705669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:25.794557Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.794557Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:f6019939a6b2e99393c50e9003afd294a5493affec36a744dccceeeb58570367","observation_id":"87efda85-7446-459c-9d51-021671a96d36","resolution":{"observed_at":"2026-08-07T10:18:25.794557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.927997Z","title":"Instantbooth: Personalized text-to-image generation without test-time finetuning","venue":null,"work_id":"a264e528-3b07-4d33-9103-762b2a252390","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.899763Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:b1c3037d64ce6b7cf26939e61df7d12776193bf69b6715f16df41563713e9f24","observation_id":"7209e051-5d65-4769-aa13-a4c9659d173b","resolution":{"observed_at":"2026-08-07T10:18:30.035495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.620049Z","title":"Few-shot font generation by learning fine-grained local styles","venue":null,"work_id":"ab72d3ba-b523-4414-8507-009b36a39793","year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.038407Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:3a9267dc2355254813221f321b4f0e5afa83a39f915fcb9a47baa03460065ad7","observation_id":"ed49de19-eecf-4c9c-a921-819518d1596a","resolution":{"observed_at":"2026-08-07T10:18:29.735342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03054","last_updated":"2024-02-21T07:12:45Z","snapshot_observed_at":"2026-08-07T22:13:54.617491Z","submitted_at":"2023-11-06T12:10:43Z","title":"AnyText: Multilingual Visual Text Generation And Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03054","snapshot_observed_at":"2026-08-07T10:18:26.191889Z","title":"Anytext: Multilingual visual text generation and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.191889Z"},"links":{"cited_paper":"/paper/2311.03054","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:9813442d3b6dd1322efce8e432037837e64275e57bb77c8055bca2fa7cebe366","observation_id":"a837eed1-0fb6-4c2f-b855-be44c226f8dc","resolution":{"observed_at":"2026-08-07T10:18:26.191889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:26.349124Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.349124Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:43454d47c4c8bdc8289348c1b4555898484d556daae90dc531e25c6079ea14a6","observation_id":"ea3cec40-97f6-4b28-bc8c-97119d012be0","resolution":{"observed_at":"2026-08-07T10:18:26.349124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.357631Z","title":"Cf-font: Content fusion for few-shot font generation","venue":null,"work_id":"43610b9a-8e4a-454b-920e-a57b125833ee","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.504600Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:f00b85c307d65a1bfc197d9953e3e8ed78f1cb3d976d7cabc46e99d75a201d80","observation_id":"770ba9ea-f120-4b72-a0da-c1da346055cd","resolution":{"observed_at":"2026-08-07T10:18:29.479530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.125929Z","title":"Deep high-resolution representation learning for visual recognition","venue":null,"work_id":"14711bb8-7316-46d0-b042-eb68c7eda2d8","year":2020},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.667658Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:eff4357e910f81c5080205aaca55a202054e2e7b05ef9f5a7948861db7e91be5","observation_id":"80d77185-b9ef-4922-a16e-b48387e8c188","resolution":{"observed_at":"2026-08-07T10:18:29.187183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07209","last_updated":"2025-03-04T06:21:26Z","snapshot_observed_at":"2026-07-06T18:28:51.180903Z","submitted_at":"2024-06-11T12:32:53Z","title":"MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07209","snapshot_observed_at":"2026-08-07T10:18:26.877834Z","title":"Ms-diffusion: Multi-subject zero-shot image personalization with layout guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.877834Z"},"links":{"cited_paper":"/paper/2406.07209","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:211924cc92c7e5611207ac3d688407fd21560771339126bff72b09366c4236b1","observation_id":"1a75200a-4fdf-459b-8c8a-150a57d29d68","resolution":{"observed_at":"2026-08-07T10:18:26.877834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:27.060424Z","title":"Elite: Encoding visual concepts into textual embeddings for customized text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.060424Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:54326a3e96ce62ed80d6ebbdd36a03202dae5d6632142c518763fceb37c3740a","observation_id":"f927e690-6ef0-4df4-baa3-7c5fc85c3263","resolution":{"observed_at":"2026-08-07T10:18:27.060424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.038820Z","title":"Rethinking text segmentation: A novel dataset and a text-specific refinement approach","venue":null,"work_id":"8c0e9e5c-0f32-4199-bbc2-3ce3c2685747","year":2021},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.220463Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:b5e84946b28ab77543701f956c15f7665cf5c1d1be25c140203cd95cc9cf87af","observation_id":"ed7753f2-d47b-4f84-8f4a-7ec6a8a73f0e","resolution":{"observed_at":"2026-08-07T10:18:29.095401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:28.837671Z","title":"Glyphcontrol: glyph conditional control for visual text generation","venue":null,"work_id":"f964fa4c-5eb0-45f8-8817-25802a8477b9","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.345507Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:b6ddf5c7239f6cec937e2dae1e419ec4369494b218eff449ec15e6b4364fd0ec","observation_id":"4c40841e-21a2-4d8b-9793-3914569b5177","resolution":{"observed_at":"2026-08-07T10:18:28.932148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:28.609663Z","title":"Fontdiffuser: One-shot font generation via denoising diffusion with multi-scale content aggregation and style contrastive learning","venue":null,"work_id":"860e9f7d-1b6d-4464-a667-49b0eddc3dbf","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.469173Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:0ed5a6ff8eef6e46f3cb641059647afa09732df0d9be12cec6486f1afa73337a","observation_id":"ce6e8cc2-2a0c-49f3-b762-df259010da78","resolution":{"observed_at":"2026-08-07T10:18:28.716248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-07T10:18:27.551786Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.551786Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:fd7b86e8fd0e8094f3c5660bcc2129fcb2fbe8cccfe256cc433a86c216d583b6","observation_id":"f686ff9e-8e4b-4241-9fa0-baec51abb5e1","resolution":{"observed_at":"2026-08-07T10:18:27.551786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:28.386684Z","title":"Jedi: Joint-image diffusion models for finetuning-free personalized text-to-image generation","venue":null,"work_id":"22ff2755-91e9-4684-9114-22e6a97292f4","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.656276Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:c3e60b343b471058554a558a7aa334d1df0d1545da06f939c7be594559985e87","observation_id":"6a932fb3-9d08-4aa4-b89c-dbc98b1f2b21","resolution":{"observed_at":"2026-08-07T10:18:28.477318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:27.747207Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.747207Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:aa6d8638ba8c02e442b95e290ed716dcdff2af7bd24003c7fb4a94210bf1ac44","observation_id":"e6764746-f08b-4c21-b0c8-8274990ffaed","resolution":{"observed_at":"2026-08-07T10:18:27.747207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:14:43.706595Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2506.05843."}