{"as_of":"2026-08-03T09:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c64e88bdf4dcd42c816df2d5d5303ce7555d8d17d3919bce784778966428506","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T22:52:41.592714Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:42:54.057921Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.10955","snapshot_observed_at":"2026-08-01T15:42:54.057921Z","title":"Omni-attribute: Open-vocabulary attribute encoder for visual concept personalization.arXiv preprint arXiv:2512.10955, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18237","last_updated":"2026-07-20T17:59:51Z","snapshot_observed_at":"2026-08-01T15:42:51.277525Z","submitted_at":"2026-07-20T17:59:51Z","title":"The Many Senses of Visual Similarity: A Text-Prompted Image Perceptual Metric","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T15:42:54.057921Z"},"links":{"cited_paper":"/paper/2512.10955","citing_paper":"/paper/2607.18237"},"observation_digest":"sha256:559742c614f21c13e6e57948a481ead91e1f1e0562f6a6f6cb6b9641126fe9a1","observation_id":"084f9d75-3c5e-4095-bc25-415c17a4a686","resolution":{"observed_at":"2026-08-01T15:42:54.057921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.10955/citation-record","integrity":"/paper/2512.10955/integrity","json":"/paper/2512.10955/citation-record.json","paper":"/paper/2512.10955"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Break-a-scene: Extracting multiple concepts from a single image","venue":null,"work_id":"43c12c58-9ca8-4e28-a9bc-e7b65d7c47f6","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:e844ccb7702dd70b96d6dc6a821170833f0ea17755b71cde1f62ed862a45c923","observation_id":"a135afec-0fd4-45ef-bc05-9bf6e3c8f215","resolution":{"observed_at":"2026-05-16T22:53:38.485849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Animal image dataset.https://www","venue":null,"work_id":"ad5190ea-e224-4903-91ce-11f2da8142c1","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:fef7fc955dc182a191ede50422e5765ffe76d323a9ab32a20fcb31a46acef126","observation_id":"54adecc3-18a4-4205-b653-7572216e7008","resolution":{"observed_at":"2026-05-16T22:53:38.572425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Precisecam: Precise camera control for text-to- image generation","venue":null,"work_id":"a6d3fad1-c699-4003-b48d-007f4b539b7e","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:8dda9042c2e24b5fe9efeee88e428f8d6a61214a049159ccd1be6eb2ee062c1e","observation_id":"cf0cb2bf-b820-4df3-9514-4ab1588e119d","resolution":{"observed_at":"2026-05-16T22:53:38.521875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"5ac1a2fb-b289-4ef3-a8c7-20fd1e60f483","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:0dfe8a07cb04ca77ecb5a34dcc509caa61a0c1eb8dd9807e8942d772b16effde","observation_id":"bbaaf0ba-458a-4bef-9581-83cafe6b974d","resolution":{"observed_at":"2026-05-16T22:53:38.617940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unsupervised learn- ing of visual features by contrasting cluster assignments","venue":null,"work_id":"7232d071-a904-4398-b7d9-f5824dbbcc7a","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:a3ccd41403d75cd7108b4b245b99240567cdce3223b079e2cbb9c9a37625f656","observation_id":"d4d070ba-df19-4d52-8414-21f4484d58d1","resolution":{"observed_at":"2026-05-16T22:53:38.509359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":"d08691b7-2390-472c-ac36-389c2cd266c8","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:3e2f7d62cf6712f25c9f88b44e9a2470cef4736fcb1aa7abb4a9838729b067fa","observation_id":"90d269b4-8426-4451-845d-3095fcd3b52a","resolution":{"observed_at":"2026-05-16T22:53:38.512705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":"d093b5b2-ed43-495a-87e3-7bf0fa84a8e3","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:52752e7085131f5d15ea69cd113047457fb47c3518d0c589d13d7d8eb0836213","observation_id":"937234cc-6818-4654-aeff-3744c6afdb2e","resolution":{"observed_at":"2026-05-16T22:53:38.630545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Incremental false negative detection for contrastive learning","venue":null,"work_id":"be9608ba-5621-4567-8950-632a78ab5155","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:5e6f066b65901cb8dea49c3ff9c5f2cf4ce684c06058c03d6d34b2a3ac3af492","observation_id":"dcdb0c6e-50c1-41d8-b101-d7c9dc54a0d8","resolution":{"observed_at":"2026-05-16T22:53:38.582713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14404","last_updated":"2023-04-27T17:59:32Z","snapshot_observed_at":"2026-07-06T15:20:53.397829Z","submitted_at":"2023-04-27T17:59:32Z","title":"Motion-Conditioned Diffusion Model for Controllable Video Synthesis","version":1},"cited_work":{"arxiv_id":"2304.14404","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.14404","snapshot_observed_at":"2026-07-03T22:49:00.819668Z","title":"Motion- Conditioned Diffusion Model for Controllable Video Synthesis","venue":null,"work_id":"4f9964d7-7be1-4a28-a838-32c54a1da3e5","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2304.14404","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:12ef11aea6810df0de11fea9c2fe27ac24a2742b404530ea62cfac0891c9772d","observation_id":"feceba76-bc59-4378-b363-919cf6c626cd","resolution":{"observed_at":"2026-05-16T22:53:38.272429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Panda-70m: Captioning 70m videos with multiple cross-modality teachers","venue":null,"work_id":"7c0a9e50-7050-467b-bf4f-349d6759f45d","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:a24a4c04d33c1cf6ba9d1bf83bfb49c64f74bb3ade4d571f798b1e005f523030","observation_id":"bb4ca136-5e46-4ed5-a2ea-23f7d15b347c","resolution":{"observed_at":"2026-05-16T22:53:38.527721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-subject open-set personalization in video generation","venue":null,"work_id":"5b6e8462-0eff-4627-9c67-563b7933bf41","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:268fb7fe3fc9980fa7907dc978cad59fb0d6c74fe57ba2031d2b193cd10e6f12","observation_id":"c3dcf6d3-ef52-4cdd-a394-70cfdcfbd8cf","resolution":{"observed_at":"2026-05-16T22:53:38.524800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual categorization with bags of keypoints","venue":null,"work_id":"2090fa98-f0b3-4318-b33d-315f767d3a5c","year":2004},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:65dbefb330c74b014dbad585f86fe84acff682b7ead352555a3d2d818f1fc45c","observation_id":"87595701-2c10-4da9-ac9c-acc1b40edef9","resolution":{"observed_at":"2026-05-16T22:53:38.580095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"e3203473-3407-40e6-99c2-a72c9d7d3dad","year":2009},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6199567521f3f0c53ab2c583b54fd2f6e26f83055e095f5604df9804a3d2898a","observation_id":"6c79b5a1-dfd3-4ad1-b9c1-59bf28e47957","resolution":{"observed_at":"2026-05-16T22:53:38.553420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"3e1c179a-7703-4b49-a701-67ecb10f5905","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:b04aaf989a0cb2a1885152a2bef993c11d97aa083d3e2f2a144e1a7e731dee84","observation_id":"dded502d-6187-4f71-a0e7-5c75d4709148","resolution":{"observed_at":"2026-05-16T22:53:38.548167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"VIMI: Grounding video gen- eration through multi-modal instruction","venue":null,"work_id":"bd2e3425-082b-44fc-a5bb-dc3bc3479ef1","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:84d72e98cdac6b4a3662d4bf96844018ef4ee3ce7146669d67ac02b362572d1d","observation_id":"f552ea87-10fc-4051-a26a-0961696a808f","resolution":{"observed_at":"2026-05-16T22:53:38.566772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion","venue":null,"work_id":"5ce014bc-8d11-40a5-9c8d-896741128ba2","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:ce8db0d1342325c208f5eb81253c3a083e96d5c7e1b303d50dbf8cfcdbaea861","observation_id":"40e3e553-fd8d-44aa-9caf-591c1b06ee37","resolution":{"observed_at":"2026-05-16T22:53:38.550922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tokenverse: Versatile multi-concept personalization in token modulation space.SIGGRAPH","venue":null,"work_id":"a04c0814-8251-4920-b8d0-0c7e5c7e2550","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:693d2a18929d877752a657ccc621ec5f5c8ab1f123621eed261af4e491bdc1b5","observation_id":"d3a325dd-bb80-4322-b9a5-27c31f328180","resolution":{"observed_at":"2026-05-16T22:53:38.569555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nano banana.https://aistudio.google","venue":null,"work_id":"589f460c-7409-4105-8c81-6fb0575866af","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6f2a1ec0853e4ba26a1574e32aa3967570ca15030efdca0d6cfd3a44927f9e66","observation_id":"6f0e21ae-1561-42cd-8b1c-17f0d2c088e2","resolution":{"observed_at":"2026-05-16T22:53:38.590793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preventing shortcuts in adapter training via providing the shortcuts","venue":null,"work_id":"e2ae1c41-2260-4ada-9583-1cf2ddef0179","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:ad38fcf9f63ed6b14d724a0270a6daab53c07af3fcebeb25d3dbf6e6ba9e98d9","observation_id":"9f4a8243-b34e-491b-a937-b661e44e2653","resolution":{"observed_at":"2026-05-16T22:53:38.575134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bootstrap your own latent-a new approach to self-supervised learning.NeurIPS","venue":null,"work_id":"e9a9c82a-060a-49ba-8ae3-a0cb20fe7bb0","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6a6cefdf557d9f56da34e317303f8bb120e99d5c16cb78353daa804ba3f1a936","observation_id":"2a0263df-9435-46ae-91cc-82c3727db99f","resolution":{"observed_at":"2026-05-16T22:53:38.545110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03168","last_updated":"2025-02-28T14:39:17Z","snapshot_observed_at":"2026-07-06T18:40:57.362549Z","submitted_at":"2024-07-03T14:41:39Z","title":"LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control","version":2},"cited_work":{"arxiv_id":"2407.03168","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.03168","snapshot_observed_at":"2026-07-04T06:19:38.680614Z","title":"Liveportrait: Efficient portrait animation with stitching and retargeting control","venue":null,"work_id":"a6d04417-1655-4dfd-91f6-8ac466a59dab","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2407.03168","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:145b6f8c8d766fb566e4bfdb19dbfa87ad3290605cebf18be97fbc0d8b1a8c9a","observation_id":"fe463ee4-32d2-4954-a820-83078ba7c67e","resolution":{"observed_at":"2026-05-16T22:53:38.289613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conceptexpress: Harnessing diffusion models for single-image unsupervised concept extraction","venue":null,"work_id":"0ccfe849-5fb4-45ce-80b3-aa3c7e5e63e9","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:bc87a4d70fb8d4184cab35e014a865eed174ed7c4aa4546d4d2459cd28b68aa9","observation_id":"4d399520-422d-41ec-883c-30ee4e787c17","resolution":{"observed_at":"2026-05-16T22:53:38.558370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:32:22.378602Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"489ff65e-fbed-4844-b013-17245f02b106","year":null},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:5308a2085fdd84de0c8750d105992626785854b6937db3b8929d45d418606928","observation_id":"906b4555-49b0-4cd8-a437-b57cd4a188ef","resolution":{"observed_at":"2026-05-16T22:53:38.539578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":"d4303681-e35f-40f2-a61b-33be7a5c5871","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:952e0b63387dd9710a38f7a7de92a725847244cc5e0f0d98bb9f9705af47a864","observation_id":"3563c2fb-5c2e-434e-ad31-b0a8e4d0a150","resolution":{"observed_at":"2026-05-16T22:53:38.500399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"b08bdf77-e907-427e-bb08-77a486be1b54","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:30704f453455c7290fe49311ef4350dd9f0071a9d0bc4176dacd4d0062986ff2","observation_id":"7dffbf1d-4e0f-4915-9c08-d34a031164ac","resolution":{"observed_at":"2026-05-16T22:53:38.542362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":"2208.01626","doi":"10.48500/arxiv.2208.01626","metadata_source":"pith","pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","venue":"cs.CV","work_id":"196f7eef-d65a-47e4-b815-9a188f6aedcf","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:911185aab85fcca44d4e6adb4c2648fb39cfffd6982100aff65defa1a9b1f50a","observation_id":"b18a65ea-0da1-4ab5-b52e-dd0f5f45fe27","resolution":{"observed_at":"2026-05-16T22:53:38.292773Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":"a1e1c797-b29c-40f0-a5dd-fe49b89c1992","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:cad1043159dbceb0a8e974ea96c4324ac3cf9e6004a50d4b7becd8cfc8fa2460","observation_id":"cf155831-b3d1-4ab8-af6a-4ef9786b22db","resolution":{"observed_at":"2026-05-16T22:53:38.536463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T00:51:39.654684Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"775d20cd-9115-46d8-9a4e-949d4c618b5c","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:4f2bea94169aa67b517f7b33662cec288bfed073aea84c808e90cb5bdd0def10","observation_id":"802da1e1-8b74-496d-9faa-f29e39a57cde","resolution":{"observed_at":"2026-05-16T22:53:38.585200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"4ebd6af6-23f8-409b-9e80-a03602f12ff2","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:3101acf6c65427a0c725547775f1dff68c1c05aeefbe09a6792f21d147809fd0","observation_id":"6d6dd839-fc04-47f5-9cc9-8dc082e8b329","resolution":{"observed_at":"2026-05-16T22:53:38.588177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instantx flux.1-dev ip-adapter page.https:// huggingface.co/InstantX/FLUX.1- dev- IP- Adapter","venue":null,"work_id":"0a00d9ae-1287-4c10-b29c-45d615225159","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:e226da682a80ecad41fd9f7a3355b7f3c07ab675cfd12e0b919aaf61b8014bc1","observation_id":"6cb43bbf-2d3a-48c6-85cc-4e9ebefab888","resolution":{"observed_at":"2026-05-16T22:53:38.555645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6b50062877c90190ff694385843221ecdf9bc6b95db4baed3ed1e1f0394bf210","observation_id":"ecb04a37-444c-4db8-8ea4-e028414db28c","resolution":{"observed_at":"2026-05-16T22:53:38.275729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet classification with deep convolutional neural net- works.NeurIPS","venue":null,"work_id":"d295ef2c-1a14-4fa2-b20e-0a3d31626f39","year":2012},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:d69e0cab73ebddda8cf5d8cb55ca6c28ae35d4639d8f630f92a120748db1e191","observation_id":"c1ffa7af-f31d-48ce-ad01-5c5e1592aaeb","resolution":{"observed_at":"2026-05-16T22:53:38.564134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":"3eda3c77-e76c-4450-8ee7-66251f0dd344","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:0b890ac967270ac63112e648487f98411421c9344a804342d0939ab0354a86bf","observation_id":"139a0520-ff74-4325-8277-6619c126c66c","resolution":{"observed_at":"2026-05-16T22:53:38.560686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flux.1-dev.https : / / huggingface","venue":null,"work_id":"16379aa4-0ad5-49ae-8f48-fa7a9ae4efe7","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:9e644867339526d0e3950bc6ad14f4c6caa20d044f7a1201e5002c2d019cc7ab","observation_id":"818d75ca-cf3d-4294-89eb-0464e28c28ca","resolution":{"observed_at":"2026-05-16T22:53:38.593538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-07-06T21:44:22.901650Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":"2506.15742","doi":"10.48550/arxiv.2506.15742","metadata_source":"pith","pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","venue":"cs.GR","work_id":"5dfe19d5-3541-4803-8fe9-3c8b9e29b281","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:1e5279ededfb6d553fca52ea7139a3e0c0bfc4521bb943468519563c8ab8f783","observation_id":"b455a4fa-a58f-47e8-8ebc-d82d74b8534f","resolution":{"observed_at":"2026-05-16T22:53:38.278959Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Distortion-adaptive salient object detection in 360 omnidi- rectional images.IEEE Journal of Selected Topics in Signal Processing","venue":null,"work_id":"2863fe55-7f25-4582-b117-2f70b346e70b","year":2019},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:31d9ae6ae0b93a652900d2a6fc2ad438af3c4b3273e1896de2e4e480bdfd4f07","observation_id":"49c7002f-fa34-40f3-94f8-6cfba3063899","resolution":{"observed_at":"2026-05-16T22:53:38.530814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a3d4ad7d-6995-42f3-a651-7ee93e10bab2","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:18a2b4ea9b29022bc7e0f80f180c932d911611f1ea8526aa317c0b6831436671","observation_id":"f9b029dc-2fe0-48be-809f-df30aa894874","resolution":{"observed_at":"2026-05-16T22:53:38.614824Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compositional visual generation with composable diffusion models","venue":null,"work_id":"c4c0c1ea-1ecb-4feb-acfd-aa51633a94e5","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:3466c8b8c0e4f42a0e1283072e16a2a238822e8e2192c01246c50a0f43239959","observation_id":"7bd59cee-5107-4d86-b731-4b1a00fc9bfd","resolution":{"observed_at":"2026-05-16T22:53:38.604881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":"2504.17761","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-07-10T01:46:41.223286Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","venue":"cs.CV","work_id":"3392f2c8-a1cb-4d6c-8c82-2cdccffa33f9","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:f7f552b47d157ccfef74f14439a60a69d4b61cc92372800c0ffe1e1232011e0d","observation_id":"c07f82d2-fc5f-4fcc-84a2-82454c1b86c6","resolution":{"observed_at":"2026-05-16T22:53:38.268979Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep learning face attributes in the wild","venue":null,"work_id":"5e622d0b-cf82-431c-9da2-5a524fa46ed5","year":2015},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:bf0b1aa770f06dcadb754fa6c41ac90da716df6623085d3f64c1cf717f2fc838","observation_id":"ba6ac549-55bb-43ef-88a5-a7f605319028","resolution":{"observed_at":"2026-05-16T22:53:38.624357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:09a59d3f14002373ff3abe4d1637b70be35f4e4c00f082b6cac7994944d73d60","observation_id":"2cbf090e-cb65-4f05-b66a-8f2ded4b9d0d","resolution":{"observed_at":"2026-05-16T22:53:38.240172Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visualiz- ing data using t-sne.Journal of machine learning research","venue":null,"work_id":"9a48706d-cec4-49af-9c75-6b9302dd3206","year":null},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:efba5ba3ad0f0048895d28b5e388a7e16b83c10c149011245996756c7d6dec9f","observation_id":"8f080c48-2655-46ee-86e2-371d59c29b0f","resolution":{"observed_at":"2026-05-16T22:53:38.612034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Snap video: Scaled spatiotemporal transformers for text-to-video synthesis","venue":null,"work_id":"942ea5d0-d110-4a5b-9e64-64cc7e1bea81","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:91c70ac6f8ed10b02659102e105d854f96dd9825809ba40969ec19c8f220bba3","observation_id":"d050ed4d-f63a-42da-b8bf-16b9b715b12a","resolution":{"observed_at":"2026-05-16T22:53:38.627376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SDEdit: Guided image synthesis and editing with stochastic differential equa- tions","venue":null,"work_id":"7c47ab1b-9542-45d4-b6b9-c0f4bbca7d48","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:016c42ae8591930674bd6c0c86044a6510fa6bc16728bf4020c66f6bee4d8bc0","observation_id":"cd02d8f1-21e7-4693-acb1-8d82f010d8ce","resolution":{"observed_at":"2026-05-16T22:53:38.479543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpt-4o.https://openai.com/index/ hello-gpt-4o/","venue":null,"work_id":"54e6995f-df3f-40c1-82a7-61292703a179","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:cad3614cb5a717daee2bb2a38c9dd6a538241b5d29ac7cfc032e829fdf074e65","observation_id":"2fc80446-f138-4cb1-8415-c98975fbc7ac","resolution":{"observed_at":"2026-05-16T22:53:38.506415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"af80435a-f2ba-4d08-ace2-b5f285352f6b","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6c6b46af36023642fdbf96feb41fbe3d5d49c7833a942e524c62ad8ad5b329dd","observation_id":"bb5a24e1-8e8f-4a96-8b04-b9090ea62411","resolution":{"observed_at":"2026-05-16T22:53:38.596484Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semantic segmentation of outdoor panoramic images.Signal, Image and Video Pro- cessing","venue":null,"work_id":"d94141a6-faf2-43a5-b631-63c3493f49ac","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:0b353c1d3d69a74578d6f18bb1bbb6b321a05d8a3532513a23cde8346309c72f","observation_id":"459aa354-eeab-476a-a8bc-d1842970d7d9","resolution":{"observed_at":"2026-05-16T22:53:38.633324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"a6575fbd-6894-462c-be3e-926ca5f5bd97","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:b2a8f008313dc12eb1891984819d3029cc4e190a7613702a22b8b99962f14ee7","observation_id":"5788af63-e56a-4118-bf72-2f6a0aaa44d8","resolution":{"observed_at":"2026-05-16T22:53:38.515780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16855","last_updated":"2025-03-09T02:57:28Z","snapshot_observed_at":"2026-08-02T11:42:06.101787Z","submitted_at":"2024-06-24T17:58:47Z","title":"DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation","version":2},"cited_work":{"arxiv_id":"2406.16855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16855","snapshot_observed_at":"2026-07-03T21:08:57.517878Z","title":"Dreambench++: A human-aligned bench- mark for personalized image generation","venue":null,"work_id":"07df1e79-a136-4532-b85e-ec5bd5030414","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2406.16855","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:84eb0de8e7e43ba9edcbb52f4d3b0c809c1c4b712f5a89d37184250f65fa5610","observation_id":"244bcbdf-1cfc-43a9-b1c4-ae1cb2e22c9a","resolution":{"observed_at":"2026-05-16T22:53:38.282818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:bf587af5a84a778f371fbc2d148cc3b823ebc1d53ced2fc20742cb70decb3db5","observation_id":"de4d2ea4-d615-46eb-9e5c-1920a1b47600","resolution":{"observed_at":"2026-05-16T22:53:38.303586Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omni-id: Holistic identity represen- tation designed for generative tasks","venue":null,"work_id":"0076a3a9-61b9-4283-a91b-746174d92897","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:add5eb801689c058dec5acd3a0a61a727791daaa14439dff52e920967c1f086e","observation_id":"95d8c6d0-25c4-4307-8444-400a9727df69","resolution":{"observed_at":"2026-05-16T22:53:38.608944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.18092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Composeme: Attribute-specific image prompts for controllable human image generation","venue":null,"work_id":"5d49e6ff-be09-4014-a836-0eaca863dbe9","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:66f780465adc1dc8ebb5760ecd37a62eabde2fa554387413b022ca2bd010b427","observation_id":"9bd81b4b-7a08-452f-b253-1745c9a128bf","resolution":{"observed_at":"2026-05-16T22:53:38.285973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20820","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:58:32.692579Z","title":"Layercomposer: Interactive personalized t2i via spatially-aware layered canvas","venue":null,"work_id":"35e5e581-ebfd-49e3-9439-96e977ff389c","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:1608c47c3be2aa2a6bae72af7ffd2c076e33ab57b5ce3594d20cd5a09329e5de","observation_id":"f675eb5a-cbba-4328-b4f6-d5556976fd15","resolution":{"observed_at":"2026-05-16T22:53:38.236417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"56a98f23-47ff-421f-8820-0ef2f55e7953","year":2021},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:4eb37668b021439c1a3cde7c71e264bc2f0f8d7ebe3105b5502d982c7b8782ca","observation_id":"330bcda7-cb81-4a61-91d1-4399e847e5f5","resolution":{"observed_at":"2026-05-16T22:53:38.577921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"1326d87d-e63d-4e09-bd2c-c7db2d5c3406","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:cff5705ba460bc6ea590186a65419f6011059feabc4b61b7ffc9faaef873457f","observation_id":"39c29ea8-0bef-4fe0-9a1b-851cd9674207","resolution":{"observed_at":"2026-05-16T22:53:38.621292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Disentan- gling visual embeddings for attributes and objects","venue":null,"work_id":"31b48f76-04d0-4b5e-9a7d-5e4088dae531","year":null},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:88070f6d49449a5ac667ea1787b2415119d8523e49758329a4ebec7092e85fca","observation_id":"4b82e551-d2e7-4cd2-8ae7-789cc4268ebf","resolution":{"observed_at":"2026-05-16T22:53:38.482541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instant- booth: Personalized text-to-image generation without test- time finetuning","venue":null,"work_id":"347925db-44ef-4cd2-b08f-9ddd2fcbb15a","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:f3e78815c45fa0e1b597cb28d91c4671a17b5093a80318a17ac67290afce4522","observation_id":"bc09e64f-106a-4d53-96ea-d78496dadf5a","resolution":{"observed_at":"2026-05-16T22:53:38.476193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.21228","doi":"10.48550/arxiv.2410.21228","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Lora vs full fine-tuning: An illusion of equivalence","venue":null,"work_id":"64c35e8b-7441-4e1e-81d0-4c8b33204da6","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:62c3dcefbd5b6e2d88036013ef84bbe9f442178d0ece85616b85d53bbb894df7","observation_id":"8b9c0484-0adc-4eee-b673-e70173cf413d","resolution":{"observed_at":"2026-05-16T22:53:38.296739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":"2508.10104","doi":"10.1055/a-2487-1252","metadata_source":"pith","pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DINOv3","venue":"cs.CV","work_id":"c8b07deb-8fe7-4e18-9620-f3569d3529ce","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:7ee554ff68a97e31e3e233535ef6a98369c57138f5e7c5bbd5ec187413adec0c","observation_id":"7e05af4e-9ee9-40f3-9e1c-d74cd159069c","resolution":{"observed_at":"2026-05-16T22:53:38.244109Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Saliency in vr: How do people explore virtual envi- ronments?IEEE transactions on visualization and computer graphics","venue":null,"work_id":"3d4c4baf-9f1b-4c67-add2-a182ac83e506","year":2018},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:7de90a7e017abd1c09c458cfed63c0181fd52b9315bb2d29753c8f4fe1d78a0e","observation_id":"ea23fe00-45aa-40bb-b116-d19e83632fa8","resolution":{"observed_at":"2026-05-16T22:53:38.488737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"05d305b3-cdb0-44f4-b488-453e0bb21c2d","year":2015},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:da6ad7a021db106593cb1b09a01ee09c87f4ef5dbe05174e52fabe996322def7","observation_id":"01e2d0ba-1b12-4d5e-a793-fcb680953cbc","resolution":{"observed_at":"2026-05-16T22:53:38.491642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":"2010.02502","doi":"10.48550/arxiv.2010.02502","metadata_source":"pith","pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-07-11T02:47:49.167563Z","title":"Denoising Diffusion Implicit Models","venue":"cs.LG","work_id":"8fa2128b-d18c-405c-ac92-0e669cf89ac0","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:2fe3a525f3a39516773c921e831cfeed77d44da085cdc8675ce9f7ebfff553d7","observation_id":"a4894817-927a-43aa-b672-26dc9839c7ac","resolution":{"observed_at":"2026-05-16T22:53:38.261587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"c4449511-f605-45bf-a4f4-369a8c9d6cf0","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:b70f1bb19f82a13773972cb1f78ad305a5d06071b201986eff1ddca7118bd283","observation_id":"714f307d-6880-4b91-9cb7-d11b8934dd3c","resolution":{"observed_at":"2026-05-16T22:53:38.494505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention is all you need","venue":null,"work_id":"e24e7889-af48-4686-82d0-784bb7704b3b","year":2017},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:d5c285579f2c1dd1ae376613fca0e87580451356569cf4d14f3f4a991d38f837","observation_id":"97b68e3f-2efb-4ad1-8ba2-880b7432d50d","resolution":{"observed_at":"2026-05-16T22:53:38.533546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Concept decomposition for visual exploration and inspiration.ACM TOG","venue":null,"work_id":"62a42ea5-5866-4670-a539-514d0f33ed8a","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:f865f88947091673262f318785bd86b88d48a4d239d1db0a1da962a52fc52f87","observation_id":"a9560e6e-7ae4-4a53-a104-676925bc60c1","resolution":{"observed_at":"2026-05-16T22:53:38.602247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-07-11T01:17:42.597062Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:f10dd7b371413037255c97ce63c4f9f85b5f677a8ec93f48685ec7d1248eea75","observation_id":"1f5b9b7e-6ac3-48c7-94a3-f851c242e8b1","resolution":{"observed_at":"2026-05-16T22:53:38.307591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chi, Quoc V","venue":null,"work_id":"292ba01d-1a74-40b8-8472-efd8769bdc10","year":2022},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:6956e7b94327d86eb7a86a3dfd7553065d276b07b7012707571aff03972df2a5","observation_id":"e5b313a4-8361-4b19-8787-61bd7a16566b","resolution":{"observed_at":"2026-05-16T22:53:38.518733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-07-11T00:07:42.221444Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:545d046dc26d848d8938bb30b8b86303593fffedf6bd38c8acf8471131d80979","observation_id":"0be264ba-085e-478d-b4dd-3f166f323722","resolution":{"observed_at":"2026-05-16T22:53:38.300363Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.06679","doi":"10.48550/arxiv.2510.06679","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Dreamomni2: Multimodal instruction-based editing and generation","venue":null,"work_id":"caa956fb-4bc6-4cba-ab91-329773bba8a1","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:1f549ba95705d1d4a9c2d6c2135a18c27ac51d17e61980c24d3436e6493b52d9","observation_id":"82be4064-a224-49e9-b72f-b33182f31d66","resolution":{"observed_at":"2026-05-16T22:53:38.254743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnigen: Unified image genera- tion","venue":null,"work_id":"4791d197-0d6c-49d1-a26a-2352420aaba2","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:c048272678915d1cf7f2a3ed861d3911f9550152092e58eb38b7582326a3a4d9","observation_id":"a613e3eb-e283-4b70-bfce-fbc5c2980317","resolution":{"observed_at":"2026-05-16T22:53:38.599352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02206","last_updated":"2025-03-04T02:36:48Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T02:36:48Z","title":"Language-Guided Visual Perception Disentanglement for Image Quality Assessment and Conditional Image Generation","version":1},"cited_work":{"arxiv_id":"2503.02206","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.02206","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language-guided visual perception dis- entanglement for image quality assessment and conditional image generation","venue":null,"work_id":"1dfe0f4a-45fd-4de9-bc67-23c5be5633d4","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2503.02206","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:bc66cb452d92bb9433f231a80d9909ae6b8872496afc881e071f97b79b45f785","observation_id":"8bd2d86a-179d-43f3-bf5a-1f73c4c8f3f9","resolution":{"observed_at":"2026-05-16T22:53:38.258446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":"2308.06721","doi":"10.48550/arxiv.2308.06721","metadata_source":"pith","pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"98e51b10-54bd-4251-8a2d-f79bd6215c19","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:782dc6fec7d6a0e6e479b54ec30e82501bce429c096011afb31bb2a67e4155c5","observation_id":"cda984eb-911b-419d-8101-fc2338d5b41c","resolution":{"observed_at":"2026-05-16T22:53:38.247542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"f81580f0-2b16-4b7f-80ec-5ff83a1c6c1a","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:4c53a5c9e793ece884e66361753558d31027afcbdce363a9d999f3499989eda7","observation_id":"b5e5538f-d825-48b0-89e6-ccdc96bb626b","resolution":{"observed_at":"2026-05-16T22:53:38.497277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A fixation-based 360 benchmark dataset for salient object detection","venue":null,"work_id":"22cb0f0f-03d4-4f80-baf3-6ba58b573632","year":2020},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:eb987a100291bf92e85c9bcf158b5181ca03a1bbfdcbe72620628c47a18c0f5c","observation_id":"8f4a0a93-befd-4e33-b3a7-c2b89b62f30f","resolution":{"observed_at":"2026-05-16T22:53:38.503231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11277","last_updated":"2023-09-12T16:28:00Z","snapshot_observed_at":"2026-08-01T19:01:47.393546Z","submitted_at":"2023-04-21T23:52:27Z","title":"PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel","version":2},"cited_work":{"arxiv_id":"2304.11277","doi":"10.48550/arxiv.2304.11277","metadata_source":"pith","pith_arxiv_id":"2304.11277","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel","venue":"cs.DC","work_id":"bee7755e-b855-401d-813a-06ae9451d768","year":2023},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"cited_paper":"/paper/2304.11277","citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:c8009281a4e3806de6596e1ca529550a2adaef1266cb097116e5c94c020a8896","observation_id":"fa9d6c83-3baa-4219-896c-a82c8b9635fc","resolution":{"observed_at":"2026-05-16T22:53:38.251173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:13.496008+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:13.496008+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.18612","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T19:26:00.768643Z","title":"person identity","venue":null,"work_id":"706e532c-2a94-4f97-8299-48ba337966c5","year":2025},"citing_paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-16T22:52:41.592714Z"},"links":{"citing_paper":"/paper/2512.10955"},"observation_digest":"sha256:21af800c2aef1df12c238e367dcb67c874bbe772e193747106e046f45b693901","observation_id":"ec9ac1c9-84d6-48f9-8219-ac02f4a241b1","resolution":{"observed_at":"2026-05-16T22:53:38.265681Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.10955","last_updated":"2026-04-30T17:59:43Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T10:58:15.331045Z","submitted_at":"2025-12-11T18:59:56Z","title":"Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":19,"verified_fuzzy":53},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 3 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 1 inbound Pith citation observation for arXiv:2512.10955."}