{"as_of":"2026-08-06T19:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c01f9072dd8c73b6f61f66215ac7e97b8251c94f79b3995baf36ca0b31d91e70","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T11:54:46.989748Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T21:41:27.903998Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T14:25:45.964685Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"cited_work":{"arxiv_id":"2601.15507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.15507","snapshot_observed_at":"2026-07-01T14:25:45.964685Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","venue":"cs.CV","work_id":"b33a480b-35e2-4bd4-94e1-938c8399adb1","year":2026},"citing_paper":{"arxiv_id":"2605.14552","last_updated":"2026-05-24T13:06:38Z","snapshot_observed_at":"2026-07-06T23:25:58.895612Z","submitted_at":"2026-05-14T08:30:34Z","title":"LiWi: Layering in the Wild","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T02:02:08.897553Z"},"links":{"cited_paper":"/paper/2601.15507","citing_paper":"/paper/2605.14552"},"observation_digest":"sha256:11ff49ce1742a75935c14411c3b42c69dc0730d3ac0447e8f198dedff5c0b91b","observation_id":"3c0945a2-e5d0-4976-bd99-9561d6d2a9ee","resolution":{"observed_at":"2026-05-15T02:03:29.118096Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"cited_work":{"arxiv_id":"2601.15507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.15507","snapshot_observed_at":"2026-07-01T14:25:45.964685Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","venue":"cs.CV","work_id":"b33a480b-35e2-4bd4-94e1-938c8399adb1","year":2026},"citing_paper":{"arxiv_id":"2605.14552","last_updated":"2026-05-24T13:06:38Z","snapshot_observed_at":"2026-07-06T23:25:58.895612Z","submitted_at":"2026-05-14T08:30:34Z","title":"LiWi: Layering in the Wild","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T10:23:18.785888Z"},"links":{"cited_paper":"/paper/2601.15507","citing_paper":"/paper/2605.14552"},"observation_digest":"sha256:0d4a03626c77748589a06da8ad0bb486696ccef336f780c85e4888769358d352","observation_id":"380cb195-4f5d-4e21-8b0d-b1ad54983eb9","resolution":{"observed_at":"2026-05-22T10:24:47.055987Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"cited_work":{"arxiv_id":"2601.15507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.15507","snapshot_observed_at":"2026-07-01T14:25:45.964685Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","venue":"cs.CV","work_id":"b33a480b-35e2-4bd4-94e1-938c8399adb1","year":2026},"citing_paper":{"arxiv_id":"2605.14552","last_updated":"2026-05-24T13:06:38Z","snapshot_observed_at":"2026-07-06T23:25:58.895612Z","submitted_at":"2026-05-14T08:30:34Z","title":"LiWi: Layering in the Wild","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T21:41:27.903998Z"},"links":{"cited_paper":"/paper/2601.15507","citing_paper":"/paper/2605.14552"},"observation_digest":"sha256:864dc5d51f693b9da347ce90db8b905f955f57f71308413088f82722388c5aee","observation_id":"922ee30a-8615-4ecc-9587-f394c11962ec","resolution":{"observed_at":"2026-07-01T14:25:45.965976Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.15507/citation-record","integrity":"/paper/2601.15507/integrity","json":"/paper/2601.15507/citation-record.json","paper":"/paper/2601.15507"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:b1e6ff70c0e346d6d9ea9eb3c33e35b829d45bd2aa45454af15b6afc8a0ed2ca","observation_id":"67ae394b-e89d-481b-97c2-c813ed720a40","resolution":{"observed_at":"2026-05-16T11:57:50.150604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving image genera- tion with better captions.OpenAI blog","venue":null,"work_id":"32195477-8e58-4331-bd85-5be2be481af6","year":2023},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:84535aefaa4d83712fbb7b5d17fbd2f5c2f44b42bcd4651f49b330e4dfadf732","observation_id":"c23f8edd-376a-4338-93b8-ac7208a43ba9","resolution":{"observed_at":"2026-05-16T12:00:53.628525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instructpix2pix: Learning to follow image editing in- structions","venue":null,"work_id":"b0b894b9-5d56-4f88-bfd3-17e7d07688ea","year":2023},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:c457f50c23973aae00a20e3a64871a0d2bb869a332746b4d28012a93035f3b17","observation_id":"e40f2fb4-ae12-4f5c-ac45-369dd3fb5494","resolution":{"observed_at":"2026-05-16T12:00:53.616102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixart-sigma: Weak-to- strong training of diffusion transformer for 4k text-to- image generation","venue":null,"work_id":"1cad1d55-0d0a-405f-92df-c69111de1ae8","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:1daefbfac4f251a24cfa95f0cd75aa273355d7357aec93649e0cd4f96fc3d90c","observation_id":"c3e4773e-577f-474b-a6cf-5444bbf51da8","resolution":{"observed_at":"2026-05-16T12:00:53.603461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":"2501.17811","doi":"10.48550/arxiv.2501.17811","metadata_source":"pith","pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","venue":"cs.AI","work_id":"67d9e391-26d1-459e-ab56-07e60511c886","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:d7a361e753a67a7b69135da5152e9cc26e9d7fa83a174ab9257d95e9d2950bb0","observation_id":"eb5c57aa-18f9-4342-b2f2-18ab64505394","resolution":{"observed_at":"2026-05-16T11:57:50.201298Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:23:49.226643Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":"6f027214-4a6c-47ae-9eb7-89a3a8e6514e","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:356d640a00e60b6e9df142370275171e70e813b0dd9983bacb5fadab4a49ef73","observation_id":"080c1d0e-c316-4d7e-b699-9eb34b841fc2","resolution":{"observed_at":"2026-05-16T12:00:53.605567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":"2412.05271","doi":"10.48550/arxiv.2412.05271","metadata_source":"pith","pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","venue":"cs.CV","work_id":"ee70bdc8-4656-4849-ada7-ce42a2278d70","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:fa1ab49837362d5a34afef9b48cda12bd854abcd9dcaaf45a87ed8ba5bd5cb09","observation_id":"4ea3da2a-1bbc-4272-82a9-df14a010fa72","resolution":{"observed_at":"2026-05-16T11:57:50.198015Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:07.858539+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:07.858539+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04460","last_updated":"2024-12-05T18:59:18Z","snapshot_observed_at":"2026-08-06T18:59:38.223405Z","submitted_at":"2024-12-05T18:59:18Z","title":"LayerFusion: Harmonized Multi-Layer Text-to-Image Generation with Generative Priors","version":1},"cited_work":{"arxiv_id":"2412.04460","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04460","snapshot_observed_at":"2026-06-30T12:04:38.908975Z","title":"Layerfusion: Harmonized multi-layer text-to-image generation with generative priors","venue":null,"work_id":"55478a7b-ca6c-467e-8542-84af237d23fd","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2412.04460","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:3ca33d05acf9adb87a45a032555ae3e03984b6644eb24cda3cc3b58b1e234467","observation_id":"4d8b62f9-d255-472b-942a-cb4a81aecf43","resolution":{"observed_at":"2026-05-16T11:57:50.213284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":"2505.14683","doi":"10.48550/arxiv.2505.14683","metadata_source":"pith","pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emerging Properties in Unified Multimodal Pretraining","venue":"cs.CV","work_id":"e0cfd82c-f5d4-44fd-b531-ec73ab0a805b","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:f46b54eeae2414f06dbceeecc66e6e9a5b45ba4895cdd6fedf1d9a20a19f0afa","observation_id":"c617c889-c8bd-4254-8cff-26a1b8218a6c","resolution":{"observed_at":"2026-05-16T11:57:50.248036Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"09412010-969a-449e-950f-20ee7b46b6bf","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:dda0362771635f6e7b33ba67467dd4602ca5e90143b1df389b7017bd0ae8444a","observation_id":"33c61263-b67d-47c3-93e7-6ddcbe57937c","resolution":{"observed_at":"2026-05-16T12:00:53.650214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"03073984-e026-4a03-8569-d0c1fa894629","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:1466e0317fd0d7554c6d2c8efad164f6fe743eb15c4fefd20554bcea1026c5d6","observation_id":"261cb8e6-da08-489e-8237-705d81824696","resolution":{"observed_at":"2026-05-16T12:00:53.644693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generating compositional scenes via text-to-image rgba instance generation.Advances in Neural Information Process- ing Systems, 37:43864–43893","venue":null,"work_id":"9af2bda9-e5dd-495f-9168-0c8dda788ab9","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:347159a5834170234ac28f661827d214bba17c69b339be870940fb3f4a36600f","observation_id":"96b3def5-17a3-4030-b591-27c21e3d6680","resolution":{"observed_at":"2026-05-16T11:57:51.089153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-scale and detail-enhanced segment anything model for salient object detection","venue":null,"work_id":"9701c584-9c67-4503-9339-19bdc193fb48","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:803cc44733021e9df8680ce27634dbdec086247ae440af335e624700e198f96d","observation_id":"b9c9ce2f-7ad1-421b-9395-3792ee5c00b1","resolution":{"observed_at":"2026-05-16T12:00:53.636625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14396","last_updated":"2025-03-02T07:53:44Z","snapshot_observed_at":"2026-07-06T18:03:51.687441Z","submitted_at":"2024-04-22T17:56:09Z","title":"SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation","version":2},"cited_work":{"arxiv_id":"2404.14396","doi":"10.48550/arxiv.2404.14396","metadata_source":"pith","pith_arxiv_id":"2404.14396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation","venue":"cs.CV","work_id":"15953092-dd9e-49ae-9f72-e28fc93a6068","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2404.14396","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:8baf27be64b2227595d4f6a54875e037314f99aa2611d36a92e92f90e8b70927","observation_id":"1507d451-6c64-4060-83a8-7e65a2f61f93","resolution":{"observed_at":"2026-05-16T11:57:50.227408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment.Advances in Neu- ral Information Processing Systems, 36:52132–52152","venue":null,"work_id":"1a34ed62-e340-4a3e-8195-a882189deb4e","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:41803bc024790c28e964421f972da9cb4e600b1ac1a4773decdfbba31d4a0edc","observation_id":"63b59802-c70e-4fe9-b7c6-a145b3640c84","resolution":{"observed_at":"2026-05-16T11:57:51.084649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium.Advances in neural information process- ing systems, 30","venue":null,"work_id":"7cbebc65-d08f-41a1-8113-91abd3d8236d","year":2017},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:5f01814b532fa73754326f77fca10071ea3944e3c381ab6ac42d88f88786247d","observation_id":"89517e56-bfaa-4d8e-9f6a-86af0cd946dd","resolution":{"observed_at":"2026-05-16T12:00:53.624307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.11468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Psdiffusion: Harmo- nized multi-layer image generation via layout and ap- pearance alignment.arXiv preprint arXiv:2505.11468","venue":null,"work_id":"2411f9ca-cedf-4dd2-88f4-533cf850d8f8","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:52bc4441f5a5ab276ef7aa91aa9dfea84c8c9414a905513452c5ac864e462bb9","observation_id":"d479035b-8d7b-482f-9bcb-60eef5372259","resolution":{"observed_at":"2026-05-16T11:57:50.191370Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flux family models.https:// huggingface.co/docs/diffusers/main/ en/api/pipelines/flux","venue":null,"work_id":"20ef37b6-b16a-4ce0-a8f5-34c1105f95f1","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:863fa9c7d2ea9f9545f26d7686709c0fc06115cc671403069d89216143a663b7","observation_id":"ecef2ef3-370d-4be4-9f0f-de73d465f687","resolution":{"observed_at":"2026-05-16T11:57:51.082267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Brushnet: A plug-and-play image inpainting model with decomposed dual-branch diffu- sion","venue":null,"work_id":"82e81ef9-fcad-464b-8585-242ba9970100","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:13b6e344ace8fd0fc7afbeebf0f29aa760cc12a0630d290da8149b683b061083","observation_id":"625994c4-4569-4e03-9352-24fd8c3ed0af","resolution":{"observed_at":"2026-05-16T11:57:51.086894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01197","last_updated":"2025-01-02T11:18:25Z","snapshot_observed_at":"2026-07-06T20:15:45.334609Z","submitted_at":"2025-01-02T11:18:25Z","title":"LayeringDiff: Layered Image Synthesis via Generation, then Disassembly with Generative Knowledge","version":1},"cited_work":{"arxiv_id":"2501.01197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01197","snapshot_observed_at":"2026-07-01T14:25:45.949877Z","title":"Layeringdiff: Layered image synthesis via generation, then disassembly with generative knowledge","venue":null,"work_id":"179ea351-ada5-4242-a582-ad3d529059e4","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2501.01197","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:77d089cd96670a6fd74e3d23c7e1d9556aefea6c51480318dc4e5a320f20f296","observation_id":"f128df37-990b-4358-b610-a0915e62a7e3","resolution":{"observed_at":"2026-05-16T11:57:50.259360Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09358","last_updated":"2025-05-14T13:07:03Z","snapshot_observed_at":"2026-08-05T14:42:31.479048Z","submitted_at":"2025-05-14T13:07:03Z","title":"Marigold: Affordable Adaptation of Diffusion-Based Image Generators for Image Analysis","version":1},"cited_work":{"arxiv_id":"2505.09358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.09358","snapshot_observed_at":"2026-07-10T02:46:42.936265Z","title":"Marigold: Affordable adaptation of diffusion- based image generators for image analysis","venue":"cs.CV","work_id":"c07f68d6-9d91-470d-9ca8-c922c371730e","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2505.09358","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:783399cd8abf6ac408a58d0dd213a7d1ca269cdc9650f745ec136140b33d214f","observation_id":"3973d0ca-1f5a-4cbb-ae0d-1c6ae6bac1f6","resolution":{"observed_at":"2026-05-16T11:57:50.255751Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Segment anything","venue":null,"work_id":"1a782a29-7e0d-48a0-9098-6aa5d9fd2e27","year":2023},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:087cbdd0f7467fbdb8498bee93358ed536cc42a97906b20d89caa7d5f536662f","observation_id":"9c26ea02-d108-4858-90a8-c26b33eda0b6","resolution":{"observed_at":"2026-05-16T11:57:51.093289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flux","venue":null,"work_id":"f57951b4-ee93-4ff3-858e-58189fe9e14e","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:91afff1576dd149300c0e691d098224a8725ab5954d0dce0342836191d127a28","observation_id":"695c805d-27f8-4069-a20c-eed7933d5593","resolution":{"observed_at":"2026-05-16T11:57:51.079993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-07-06T21:44:22.901650Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":"2506.15742","doi":"10.48550/arxiv.2506.15742","metadata_source":"pith","pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","venue":"cs.GR","work_id":"5dfe19d5-3541-4803-8fe9-3c8b9e29b281","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:39a242e1f10d85520af724bc307d28d0f3cc30c2158c37b099de3ea38597c1ba","observation_id":"893a470a-b52e-4132-bdf8-c3386355dda3","resolution":{"observed_at":"2026-05-16T11:57:50.240988Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03147","last_updated":"2025-06-18T18:00:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-03T17:59:33Z","title":"UniWorld-V1: High-Resolution Semantic Encoders for Unified Visual Understanding and Generation","version":4},"cited_work":{"arxiv_id":"2506.03147","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03147","snapshot_observed_at":"2026-07-05T16:51:14.197597Z","title":"UniWorld-V1: High-Resolution Semantic Encoders for Unified Visual Understanding and Generation","venue":"cs.CV","work_id":"488a273e-95d8-46f1-87c7-2244068d00d0","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2506.03147","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:3b31423a5e1d410e1277e40042cf7ec9f76b5280724fa4d7d099d0adc75c8b8a","observation_id":"ea8bcc89-176e-477f-9e31-8b6fd13e24b1","resolution":{"observed_at":"2026-05-16T11:57:50.157306Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Microsoft coco: Common ob- jects in context","venue":null,"work_id":"848edf0a-20a3-452d-866f-494fc2391a89","year":2014},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:7d2d0ca114df787d1bcbe6ef0fa62014006bb25256f200d78cda565ec1059d18","observation_id":"a470ea8b-038c-4420-aaf4-2848f669fb70","resolution":{"observed_at":"2026-05-16T12:00:53.634204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:49018045c3be38f9e44cc967560eeb1ec326e8262235f4306c67959032aa8e2e","observation_id":"aa3214ec-21ac-4b22-95bb-af8efd71f97f","resolution":{"observed_at":"2026-05-16T11:57:50.180996Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08268","last_updated":"2025-02-03T21:47:31Z","snapshot_observed_at":"2026-08-05T16:01:06.026395Z","submitted_at":"2024-02-13T07:47:36Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","version":4},"cited_work":{"arxiv_id":"2402.08268","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.08268","snapshot_observed_at":"2026-07-04T10:59:46.566942Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","venue":"cs.LG","work_id":"162054d2-6f8e-4dc0-87b8-ebff78210c7c","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2402.08268","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:94022ed9c84a47b4123250e2d5e26428c418fc8def8e9da46a5150c7ad422dfe","observation_id":"7a465e3d-8337-4053-8d1d-a62ee611188b","resolution":{"observed_at":"2026-05-16T11:57:50.216612Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":"2504.17761","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-07-10T01:46:41.223286Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","venue":"cs.CV","work_id":"3392f2c8-a1cb-4d6c-8c82-2cdccffa33f9","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:ca3b38ed8074b8649c56135f3bb3fa4e2160cf9d24fb17046bcf3dfec3d6c5ee","observation_id":"fa367018-3a6d-4128-b2bc-a52e772891a2","resolution":{"observed_at":"2026-05-16T11:57:50.177758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06520","last_updated":"2026-05-31T09:29:40Z","snapshot_observed_at":"2026-08-05T01:42:30.194131Z","submitted_at":"2025-03-09T08:48:51Z","title":"Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement","version":3},"cited_work":{"arxiv_id":"2503.06520","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.06520","snapshot_observed_at":"2026-07-04T19:30:08.050016Z","title":"Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement","venue":"cs.CV","work_id":"7a33b2a4-8409-4a00-ad7b-84e810df1ba7","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2503.06520","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:59cb98ec98193fed57082f1267ab42241809993d7fe944e5ecfe55816650437d","observation_id":"745c99d1-8653-402f-8681-e9a1ed49985b","resolution":{"observed_at":"2026-05-16T12:31:43.641168Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpt image 1.https://platform","venue":null,"work_id":"9e8888f4-51f6-473e-82f0-77d74ae63871","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:a9dd09f84fa7f37677d1c4bf18b2e96d6ca6da5dc9e93f9e702c4e039276522b","observation_id":"b70eaf92-cb99-4941-b97a-6536680cd353","resolution":{"observed_at":"2026-05-16T11:57:51.095310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"091065a1-4eed-4daf-bcba-eb9a2171b1dc","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:6f7de0d0d2eb6d6eac3f836da42f946e23f27b0ce2ab3aa926fb5f89895018e2","observation_id":"08a076e5-fa43-46db-ae14-86bb26fd826b","resolution":{"observed_at":"2026-05-16T12:00:53.630639Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06256","last_updated":"2025-04-08T17:58:47Z","snapshot_observed_at":"2026-08-03T00:43:33.310493Z","submitted_at":"2025-04-08T17:58:47Z","title":"Transfer between Modalities with MetaQueries","version":1},"cited_work":{"arxiv_id":"2504.06256","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.06256","snapshot_observed_at":"2026-07-04T16:39:58.250680Z","title":"Transfer between Modalities with MetaQueries","venue":"cs.CV","work_id":"a89f31c1-6a3f-451e-9971-692c11219ea3","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2504.06256","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:bfd4fa30bb062c789a1897dd05ad1cb9c090ac57f16927356a31d7e2146dbf99","observation_id":"48d2aa96-6749-4e74-bb0f-065ca4e665eb","resolution":{"observed_at":"2026-05-16T11:57:50.174372Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On aliased resizing and surprising subtleties in gan evalu- ation","venue":null,"work_id":"d19acd3b-b591-4172-95a1-8d10eb35f9ae","year":2022},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:e97ba9f69b571512abdc7f396f01f33f24c7d09a51fda7a5407cb4a5c870a0cb","observation_id":"94466d44-3d95-4150-8477-6418fb5431b4","resolution":{"observed_at":"2026-05-16T12:00:53.618368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffu- sion models with transformers","venue":null,"work_id":"52632751-a7d6-44cc-b25b-cf8e089a86ab","year":2023},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:dad0436bbab8a7db2f11fdbc05ad5d6f6403a95ec0d63e97615ea1d2a0ff348a","observation_id":"5bca1c96-aa86-4571-871d-1508423c5142","resolution":{"observed_at":"2026-05-16T12:00:53.626244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:249dd7448ee3fd187507a12d9226344c429bcf55dc56d15da5b29caf1d989fec","observation_id":"4b1d5d41-d740-468f-9d33-5b7bbc57ba2d","resolution":{"observed_at":"2026-05-16T11:57:50.184235Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"6d7b488e-822d-4b74-a744-986ec81a3896","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:a1f3aeb70bbe1b8a4b12b76f32d9fc6641f91c473f6d86e4ec365951f1498e86","observation_id":"0fdac73d-d768-458d-bb49-7cab7fc43138","resolution":{"observed_at":"2026-05-16T12:00:53.633028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03069","last_updated":"2025-08-07T09:08:33Z","snapshot_observed_at":"2026-07-06T20:01:23.373458Z","submitted_at":"2024-12-04T06:46:55Z","title":"TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":"2412.03069","doi":"10.48550/arxiv.2412.03069","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03069","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tokenflow: Unified image tokenizer for multimodal understanding and generation","venue":"arXiv (Cornell University)","work_id":"6a964215-761a-438d-b579-a2699f32913f","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2412.03069","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:34a37b1f9771dd4dd611550ced636f302e336aabb0aa653938e46df526b84e1d","observation_id":"b88afb4d-7579-4fad-ae74-0661592f29e0","resolution":{"observed_at":"2026-05-16T11:57:50.252224Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer.Jour- nal of machine learning research, 21(140):1–67","venue":null,"work_id":"b282dc61-9d06-44c2-bf60-0db1d9ad1749","year":2020},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:49977882ff1363a7f23086e5d455a66407960c1b504a5a37fabfda0cfe3474ed","observation_id":"8744be27-5bea-4d85-b943-21011f870dce","resolution":{"observed_at":"2026-05-16T12:00:53.647645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"44e238e0-3f2b-44fe-ad14-b2060c145aa4","year":2021},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:90bec7ee6c44c993ae0a97993716daaeec1ab747a7c0157b822b0662bfcde5ed","observation_id":"e8840ccd-87fb-450e-a4a8-4768f0d4ba02","resolution":{"observed_at":"2026-05-16T12:00:53.629428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":"2204.06125","doi":"10.48550/arxiv.2204.06125","metadata_source":"pith","pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","venue":"cs.CV","work_id":"0c6a768b-70b8-4242-bb0e-459f1008c9fc","year":2022},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:57427ca0ea6c28d302b32ced86e22909f8ba38723b5a45bd65af742e663a8ff1","observation_id":"51a50ffe-3557-4c0e-908e-dd363d24d8b7","resolution":{"observed_at":"2026-05-16T11:57:50.194336Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":"2408.00714","doi":"10.1038/s41598-025-97590-3","metadata_source":"pith","pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 2: Segment Anything in Images and Videos","venue":"cs.CV","work_id":"acc13f66-d814-44f9-9688-375688bf2d4a","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:7276c4c9304d83f167ae9c36309282f27d42fced6740faa54828aefbe1b48399","observation_id":"3fece346-5606-4035-8ca8-fd240b882755","resolution":{"observed_at":"2026-05-16T11:57:50.244408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":"2401.14159","doi":"10.48550/arxiv.2401.14159","metadata_source":"pith","pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","venue":"cs.CV","work_id":"42c46ece-c4e8-4d5e-abae-f8d5b4208995","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:12eb53a431f610275bec38581975b10455dfdb0f929c34a63ca06978b36be6a8","observation_id":"a0356251-d514-4979-8eac-588f98b7a94e","resolution":{"observed_at":"2026-05-16T11:57:50.167584Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":"89d81686-9641-405c-a4d3-c728ed725373","year":2022},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:8c9d67dbdb51230543f725f9bf9c52f4850136651bac77fd12a534b1fcabe996","observation_id":"2abb2a11-9900-441c-924b-4c68b76b80c5","resolution":{"observed_at":"2026-05-16T11:57:51.075535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":"2405.09818","doi":"10.48550/arxiv.2405.09818","metadata_source":"pith","pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","venue":"cs.CL","work_id":"2661b9a6-25cc-41a1-8100-612d2b801289","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:7ae4477e95600f2c5f7a326900747a0849c2de43b4e61653f7bd438b49a05805","observation_id":"72660d47-9c10-4417-bb72-148942bc69f4","resolution":{"observed_at":"2026-05-16T11:57:50.237459Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T17:49:22.013335+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T17:49:22.013335+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mulan: A multi layer annotated dataset for controllable text-to-image generation","venue":null,"work_id":"71ce1c2e-6765-40d6-a45f-616cfce759f4","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:ff431d16a9336438750d35a82284addf70a696b69fe943d016b2c82d854cb469","observation_id":"660da2a3-da14-468e-8d42-54b5f44b1ea0","resolution":{"observed_at":"2026-05-16T11:57:51.099633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unsplash: Free high-resolution photos","venue":null,"work_id":"aabf08b9-0a25-4d11-910c-4977c8c43f20","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:96d8424a62dd6dcaada11e53876d6f0a0fcab418104065d504efe4ce2561b6e5","observation_id":"e4920211-a657-45a8-8153-bc5f29c7b4c2","resolution":{"observed_at":"2026-05-16T12:00:53.639067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06673","last_updated":"2024-12-09T17:11:50Z","snapshot_observed_at":"2026-07-06T20:04:01.034597Z","submitted_at":"2024-12-09T17:11:50Z","title":"ILLUME: Illuminating Your LLMs to See, Draw, and Self-Enhance","version":1},"cited_work":{"arxiv_id":"2412.06673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.06673","snapshot_observed_at":"2026-07-03T17:58:47.404850Z","title":"Illume: Illuminating your llms to see, draw, and self-enhance.arXiv preprint arXiv:2412.06673, 2024a","venue":null,"work_id":"0724bbe6-f375-4b35-a2a3-dc6547cea7ab","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2412.06673","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:d7c5f5d4cfca9a49f40df3e34cf3d0b53833547224014810d2135b9bee209209","observation_id":"6831a40b-0b95-46e9-a4b1-5bd3a654a024","resolution":{"observed_at":"2026-05-16T11:57:50.209325Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instance shadow detection with a single- stage detector.IEEE transactions on pattern analysis and machine intelligence, 45(3):3259–3273","venue":null,"work_id":"fc9d549b-176f-47e1-baa6-096792304331","year":2022},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:e3b352f86e28d26e2e97aa056ec1da62c249cb646a90f046849553fe880023f3","observation_id":"1b67a0fa-693f-405c-93a8-f3c579525e5a","resolution":{"observed_at":"2026-05-16T11:57:51.073276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":"2409.18869","doi":"10.48550/arxiv.2409.18869","metadata_source":"pith","pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emu3: Next-Token Prediction is All You Need","venue":"cs.CV","work_id":"720d288e-fac0-464c-9929-19efd9a52afc","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:88cd561ae4075266bab1667243dc68fdfa06993ec63b46d02a2675f88af79f0d","observation_id":"e2ef605a-db40-4312-be6a-61d3dbd95dc0","resolution":{"observed_at":"2026-05-16T11:57:50.147690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07397","last_updated":"2025-03-11T14:04:38Z","snapshot_observed_at":"2026-08-02T08:10:02.416676Z","submitted_at":"2025-01-13T15:12:40Z","title":"OmniEraser: Remove Objects and Their Effects in Images with Paired Video-Frame Data","version":3},"cited_work":{"arxiv_id":"2501.07397","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.07397","snapshot_observed_at":"2026-07-04T19:30:07.390367Z","title":"Omnieraser: Remove objects and their effects in images with paired 10 video-frame data.arXiv preprint arXiv:2501.07397","venue":null,"work_id":"cd552dd9-2320-4c7d-b1fe-7f15ba48114d","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2501.07397","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:962e27466f3adb2b754aa6642d5a4abe51855356186e5f0e3f26a30f2ecafa0d","observation_id":"2dd93760-c8ed-4735-8f11-c8c45b74e981","resolution":{"observed_at":"2026-05-16T11:57:50.161193Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object- drop: Bootstrapping counterfactuals for photorealistic object removal and insertion","venue":null,"work_id":"de8e4d6c-3113-401b-a3e4-b2bf62d12b91","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:ce1d896b92ee8fb044b2fa82ac56046330a7f425db01f74b04d15a009fd2bee0","observation_id":"3c358a06-0ea5-4d28-8f77-fb0355be99e3","resolution":{"observed_at":"2026-05-16T11:57:51.068490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":"2410.13848","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-07-04T10:19:47.348172Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","venue":"cs.CV","work_id":"8aa59998-5ac6-4ee1-bcb4-cf7fe479058b","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:75c6201f73da0c92a64cf2476648b2daeead07ea621d3eae0a4191220358cfa7","observation_id":"0c92de20-fb3a-4e5d-a697-88bae47b4b87","resolution":{"observed_at":"2026-05-16T11:57:50.164174Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:73811a5729936a1cea06a8e58b05e668d8b017e0cbc8c18757241f9c6fee0fc5","observation_id":"ff000161-f91a-4438-96fd-b12ab4f1bdfd","resolution":{"observed_at":"2026-05-16T11:57:50.140462Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18871","last_updated":"2026-04-21T17:32:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-23T17:38:54Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","version":4},"cited_work":{"arxiv_id":"2506.18871","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18871","snapshot_observed_at":"2026-07-10T01:46:41.215139Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","venue":"cs.CV","work_id":"d3153e5f-b6e2-4ab3-9f41-e24e24d64496","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2506.18871","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:fe82178ea55a887115e218ab14317915aa2e704f2e811497bd0ffdde5e932492","observation_id":"0fde9377-a7af-4fc8-886a-23b5b077b765","resolution":{"observed_at":"2026-05-16T11:57:50.137049Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":"2408.12528","doi":"10.48550/arxiv.2408.12528","metadata_source":"pith","pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","venue":"cs.CV","work_id":"1393dc24-a6b2-44e1-b5d7-7009d1fa4811","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:2ec7d3ce2dcef84239be3d3cf949f6ba863c5fe59ddaffc6b44da3fe7c960719","observation_id":"f5b06fec-209c-45e1-89ea-5fe6b129c838","resolution":{"observed_at":"2026-05-16T11:57:50.234347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative image layer decomposition with visual effects","venue":null,"work_id":"b6fba86c-1d5e-4a0f-b426-60cc33896dc9","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:deb2a5962417fe9b8cfce8304e6c08e53f01263c65e36c61f324711b9c9a3a77","observation_id":"7744e0a6-6ef1-44c0-a454-13eff56fe452","resolution":{"observed_at":"2026-05-16T11:57:51.070955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13143","last_updated":"2025-04-17T17:51:59Z","snapshot_observed_at":"2026-07-06T21:11:05.749637Z","submitted_at":"2025-04-17T17:51:59Z","title":"$\\texttt{Complex-Edit}$: CoT-Like Instruction Generation for Complexity-Controllable Image Editing Benchmark","version":1},"cited_work":{"arxiv_id":"2504.13143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.13143","snapshot_observed_at":"2026-07-02T01:06:23.900532Z","title":"Complex- edit: Cot-like instruction generation for complexity-controllable image editing benchmark.arXiv preprint arXiv:2504.13143","venue":null,"work_id":"3e4778c3-81ed-439d-b5ee-96b6f734ff44","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2504.13143","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:2d4461a272569c231d67d53266b34acdc061fc529a677dbfba0af778d61553d6","observation_id":"825b9327-b11d-4704-a225-1cfd4c49be71","resolution":{"observed_at":"2026-05-16T11:57:50.230872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20275","last_updated":"2025-05-26T17:53:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-26T17:53:33Z","title":"ImgEdit: A Unified Image Editing Dataset and Benchmark","version":1},"cited_work":{"arxiv_id":"2505.20275","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20275","snapshot_observed_at":"2026-07-10T13:27:05.927875Z","title":"ImgEdit: A Unified Image Editing Dataset and Benchmark","venue":"cs.CV","work_id":"059b5c3a-404c-4d30-a631-68c1d88a08a7","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2505.20275","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:de1945753141b6f97bc3361cd83f71694ba9628e6ac0b934dac1bfb9b4496443","observation_id":"7fb50555-a184-4aa7-bcdd-7a78773d757f","resolution":{"observed_at":"2026-05-16T11:57:50.144454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anyedit: Mastering unified high-quality image editing for any idea","venue":null,"work_id":"c7cf7eb0-cf00-4daa-91a7-fed0bceec609","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:0810434dc260653bbdbad811f3defc9207b6e14574b57349a916ad756af911dc","observation_id":"6119f748-0f46-4868-9c15-89e22d184bba","resolution":{"observed_at":"2026-05-16T11:57:51.063583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magicbrush: A manually annotated dataset for instruction-guided image editing.Advances in Neu- ral Information Processing Systems, 36:31428–31449","venue":null,"work_id":"435c0ce4-22dc-4bbf-8027-1661efce36ef","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:06daabf75002cb272324c622ac0b24bd0c805f5bc27914fb77124aa09c8a904e","observation_id":"02d185b8-6c6e-4ee5-b03b-5ac7f2ba5651","resolution":{"observed_at":"2026-05-16T11:57:51.065919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17113","last_updated":"2024-06-23T03:47:27Z","snapshot_observed_at":"2026-07-06T17:35:53.644734Z","submitted_at":"2024-02-27T01:19:53Z","title":"Transparent Image Layer Diffusion using Latent Transparency","version":4},"cited_work":{"arxiv_id":"2402.17113","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17113","snapshot_observed_at":"2026-07-04T09:39:46.135097Z","title":"Transparent image layer diffusion using latent trans- parency","venue":null,"work_id":"405aeea0-0af6-4f48-bd4a-24982f8a6420","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2402.17113","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:7049d677f9123b5ee3bc674251cf1ae875c3479b0d31980e211adae03dd1d889","observation_id":"93b75084-304a-4469-bf32-0ed663278a30","resolution":{"observed_at":"2026-05-16T11:57:50.205421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"08871d01-ffd2-4cf4-aa2a-4ed00688bbfa","year":2023},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:b39e560ea8a34e98e11fd54954c8ca8cb35a2a00a7ce6908ba18f325359c1b83","observation_id":"fd63b0b0-a2af-4fe2-9032-110269dbe034","resolution":{"observed_at":"2026-05-16T11:57:51.077809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The unreasonable ef- fectiveness of deep features as a perceptual metric","venue":null,"work_id":"76155b53-2710-4170-84ae-9b954e219f78","year":2018},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:bd76477087d85a6a48d8bc1f09120433e9bdc40f59a4b7d0096ed820923b1cca","observation_id":"98fd5801-6277-4739-8b29-a754f838eb19","resolution":{"observed_at":"2026-05-16T12:00:53.621407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09781","last_updated":"2023-07-19T06:56:07Z","snapshot_observed_at":"2026-07-06T15:55:45.131112Z","submitted_at":"2023-07-19T06:56:07Z","title":"Text2Layer: Layered Image Generation using Latent Diffusion Model","version":1},"cited_work":{"arxiv_id":"2307.09781","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.09781","snapshot_observed_at":"2026-07-01T14:25:45.959786Z","title":"Text2layer: Layered image generation using latent diffusion model","venue":null,"work_id":"614f625c-c4be-459d-a11e-726fe5db07c2","year":2023},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2307.09781","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:a4a77f8e4e85d7370c39ef7864a10711024c8c1e4a1c9d323da41f385cc23d3c","observation_id":"e4304bed-ad23-4032-baf6-652bf75217e0","resolution":{"observed_at":"2026-05-16T11:57:50.223899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20690","last_updated":"2025-09-23T02:34:36Z","snapshot_observed_at":"2026-08-05T06:11:45.068217Z","submitted_at":"2025-04-29T12:14:47Z","title":"In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer","version":3},"cited_work":{"arxiv_id":"2504.20690","doi":"10.48550/arxiv.2504.20690","metadata_source":"pith","pith_arxiv_id":"2504.20690","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer","venue":"cs.CV","work_id":"8cafd680-1279-4695-8156-9079db325469","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2504.20690","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:44a8bb3e8592e7908b507b4cbfe46ff5c0fc56e575bdd9aef09022b9add170eb","observation_id":"79982f45-67bc-4e31-8bc3-4cc076b602c4","resolution":{"observed_at":"2026-05-16T16:07:53.247084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ultraedit: Instruction-based fine-grained image editing at scale","venue":null,"work_id":"d2ad703d-345e-4395-b623-2bcd56b38bff","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:763822a67b126b6f5170b5aa0915e9763e1effcfebfa5370ca31fea277a21de8","observation_id":"c16b003c-2dc3-47f6-abd2-9d655e345a4a","resolution":{"observed_at":"2026-05-16T11:57:51.091327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.22636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:13:15.729241Z","title":"ObjectClear: Complete object removal via object-effect attention","venue":null,"work_id":"97d3da34-906c-46e9-8d2f-2ccf03802379","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:aa8f9c2cafe06066927240f8fe2c3483c16196dbcecce96dd96fdfb0ce3b50e4","observation_id":"b95cae79-5dc8-4c97-be75-189e020093ee","resolution":{"observed_at":"2026-05-16T11:57:50.187534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tp-blend: Textual- prompt attention pairing for precise object-style blend- ing in diffusion models.Transactions on Machine Learning Research","venue":null,"work_id":"f76f4260-dbc8-4885-9376-4cc15030a879","year":2025},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:6b1fea7373f2f202e21b4c68c077995a940f75d15265db4dbb3897cb3ac2d17e","observation_id":"fbd30a46-3fff-4a34-b3f5-a5e69f040abc","resolution":{"observed_at":"2026-05-16T12:00:53.641799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":"2408.11039","doi":"10.48550/arxiv.2408.11039","metadata_source":"pith","pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","venue":"cs.AI","work_id":"c2bb4d2d-29de-4bf2-9150-3d6373ff358f","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:329ae24c56493a6024a67fc57680940199a36ff9ea236da91ec1e388c87c65d9","observation_id":"2c7f30ac-1ed0-4244-87a0-5431c7eb66b1","resolution":{"observed_at":"2026-05-16T11:57:50.171082Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Addition","venue":null,"work_id":"b48b310e-a54b-41d5-9593-0d4414951438","year":2024},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:aa9bd7491f5f5aab45bfd1bd51b37e10cfccf455bb26a425ccca264f9450caf8","observation_id":"3bbc9cb1-8497-4818-b821-dad3700fc643","resolution":{"observed_at":"2026-05-16T12:00:53.592348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Addition","venue":null,"work_id":"614b3e3b-6227-4c7a-8a05-c269daf5a195","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:9698851197bd927f7de98ba2b7c1721287b8767d942c8eb46ae5450d2d1ac63b","observation_id":"9497fd29-402c-43b7-8ab1-c4a2f848c3a3","resolution":{"observed_at":"2026-05-16T11:57:51.061422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"11, we provide more results of our model under three different modes (FG Gen, BG Gen, and Text2All)","venue":null,"work_id":"332d9218-582d-4bf6-9034-fc00a9a58c21","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:68a9ef1664aec508796aee7f5f3cb021dea9610b05b50dec85f31972402f0b36","observation_id":"b7837a65-fff4-406f-9a0a-19f989e6573e","resolution":{"observed_at":"2026-05-16T11:57:51.097484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"12, we provide more samples from LASAGNA-48K","venue":null,"work_id":"b97aad16-a551-4507-aad0-791514545a1d","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:24e0663d21fe4048a12d3a29234b51a3a81f1ab9e45b450fc1db788ef126423e","observation_id":"4b8ae453-037b-46dd-ae30-3444619ad012","resolution":{"observed_at":"2026-05-16T11:57:51.101606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"13, we provide more samples from LASAGNABENCH","venue":null,"work_id":"0912e112-7e00-4a21-950a-4a4ecfdf9eae","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:07f0b3a2301b526e5031e03d26cb8a9cc91426c5f4a5f5e051185b6489d4a3b1","observation_id":"22ba6195-69d9-461c-98bd-5e2512f85245","resolution":{"observed_at":"2026-05-16T11:57:51.059433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GPT Score","venue":null,"work_id":"37772f85-a453-4bc7-a37c-85f3a5a77c0c","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:c38953f5282ba9e5f27f3b8542d02b9fe078398eed9c53dfa42a5a49825ffd20","observation_id":"529b7732-04bc-4bb5-a6eb-56a6361bc56c","resolution":{"observed_at":"2026-05-16T12:00:53.626810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The results show the superiority of our generation paradigm","venue":null,"work_id":"321bc0f7-f6d8-4989-a6e4-f1b63008e21f","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:8cecf4f5caa7765c4fd41ede44f309d6d0c6a59b1145b532399ead794754dd7e","observation_id":"e42a5b44-1002-46e6-a43a-ad856e3fc0f3","resolution":{"observed_at":"2026-05-16T12:00:53.616272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6a2affe3-091c-4fb9-8a89-3d1fb3d6f4eb","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:4d46dfbbfa1a2f1fccb90d1dad119e8d0a44d982d56bb04399e151ad2785d8c0","observation_id":"e07b29cb-a68e-4174-97c1-4712fbe83ebb","resolution":{"observed_at":"2026-05-16T12:00:53.635083Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FG Gen” denotes background-conditioned foreground layer generation, “BG Gen","venue":null,"work_id":"04a503f9-d03d-45a7-a4e0-f2e847eef030","year":null},"citing_paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:46.989748Z"},"links":{"citing_paper":"/paper/2601.15507"},"observation_digest":"sha256:51ef4c6c9f05cdf44eeed3ea199bfe46855acaa8bc0c5ffb849dc306f17e24c7","observation_id":"c6a998a6-abc8-43c2-9a33-7f52a39b3e3f","resolution":{"observed_at":"2026-05-16T12:00:53.611488Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.15507","last_updated":"2026-05-08T04:00:14Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T22:29:33Z","title":"A Unified and Controllable Framework for Layered Image Generation with Visual Effects"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":36,"verified_fuzzy":40},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 3 inbound Pith citation observations for arXiv:2601.15507."}