{"as_of":"2026-08-05T06:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b758c2fde3cf61816b58b2c248c1870cefdb6aaf8c37cceb45ccd657d1e745d","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T16:55:19.763050Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.25636/citation-record","integrity":"/paper/2604.25636/integrity","json":"/paper/2604.25636/citation-record.json","paper":"/paper/2604.25636"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:fb4c283b9dfe18c6f1e43930b37d5e9ce9c5ac0eb55950dbab9cbdc5cc46c2a8","observation_id":"66746c33-04a7-4097-b5ed-e6934f571539","resolution":{"observed_at":"2026-05-11T23:31:14.379637Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICCV (2015)","venue":null,"work_id":"bb841b0b-cb76-4eaf-a312-3ba498137f02","year":2015},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:d04476a615e1aab2e35f35f6dd1012c5c8634ae4186457e3c2bae9eb001d1bf8","observation_id":"742fe87d-8177-4a53-881b-c38ce93678eb","resolution":{"observed_at":"2026-05-27T01:38:23.267962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:8fa2ee3edc428ec7c325f6aede57527d7bb4eeb22a7a33d5292ac37cf89a5a9a","observation_id":"7cdc6705-f45e-4059-aee3-e3e53f4afbba","resolution":{"observed_at":"2026-05-11T23:31:14.256993Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenAI technical report (2023)","venue":null,"work_id":"71b26ee4-6a19-4f42-a110-856dad030a33","year":2023},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:c6e9847e06061b8aff2ea1542d06022ad97a0f6c48ed6cbb5a87aa326288d996","observation_id":"92f01916-d636-419b-b19f-2dab002d8772","resolution":{"observed_at":"2026-05-27T01:38:23.280254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23951","last_updated":"2026-06-26T07:53:46Z","snapshot_observed_at":"2026-08-04T14:42:12.962842Z","submitted_at":"2025-09-28T16:14:10Z","title":"HunyuanImage 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":"2509.23951","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23951","snapshot_observed_at":"2026-07-04T16:59:57.981208Z","title":"HunyuanImage 3.0 Technical Report","venue":"cs.CV","work_id":"36511e33-8360-43dd-9407-dddf867c1d7c","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2509.23951","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:fe5b86c9a0d6d6d02d5fd649aa73598ba051d9067cd1715f1a5a5de372fa418b","observation_id":"6e774047-4477-4da0-8c19-0e869a999b2e","resolution":{"observed_at":"2026-05-16T02:02:32.945705Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09568","last_updated":"2025-05-14T17:11:07Z","snapshot_observed_at":"2026-07-06T21:23:57.084147Z","submitted_at":"2025-05-14T17:11:07Z","title":"BLIP3-o: A Family of Fully Open Unified Multimodal Models-Architecture, Training and Dataset","version":1},"cited_work":{"arxiv_id":"2505.09568","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.09568","snapshot_observed_at":"2026-07-08T00:04:22.585543Z","title":"BLIP3-o: A Family of Fully Open Unified Multimodal Models-Architecture, Training and Dataset","venue":"cs.CV","work_id":"86d896d2-592f-4d9b-938e-dfeb11f9388f","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2505.09568","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:0c236521bf0f3f12780a073e4756e4dbfb08914c25fb1db2763d2e86b7140123","observation_id":"b3efde80-7ebe-4c57-a0da-8bdcc47723b4","resolution":{"observed_at":"2026-05-11T23:31:14.365329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.15857","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T16:51:14.299739Z","title":"Blip3o-next: Next frontier of native image generation","venue":null,"work_id":"b51bf787-a19b-47bb-9114-1a1a29263297","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:354f290f7e41297bcc7c845df16d19052c460eebc5e6d2a185c220ac1bd0316d","observation_id":"542bfe51-e561-470f-ab2b-a78b7dcb5d7a","resolution":{"observed_at":"2026-05-11T23:31:14.349163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICLR (2024)","venue":null,"work_id":"46e78a11-9878-49cd-98a1-5c0921a1a278","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:179b6a6c6e1f5db8aee25110958c373d2c38f51f11e4221fe4ea0c1b4671ed76","observation_id":"d6b539a3-1f05-44bb-b13a-23e740583d2c","resolution":{"observed_at":"2026-05-27T01:38:23.366624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":"2501.17811","doi":"10.48550/arxiv.2501.17811","metadata_source":"pith","pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","venue":"cs.AI","work_id":"67d9e391-26d1-459e-ab56-07e60511c886","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:3204f0dc285b1894595086633655845b2f9268551d3461575bd9999ec52ad911","observation_id":"338520bb-665a-48dc-ac89-5413ca7a6aa3","resolution":{"observed_at":"2026-05-11T23:31:14.333401Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:7617492710c8824b82a2f9705da2d21cb3356ad8823d0d360118ce720c3a314b","observation_id":"e8aa972d-b59b-4ae5-a43a-f5d79377e316","resolution":{"observed_at":"2026-05-11T23:31:14.400267Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15807","last_updated":"2023-09-27T17:30:19Z","snapshot_observed_at":"2026-08-02T11:54:13.342379Z","submitted_at":"2023-09-27T17:30:19Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","version":1},"cited_work":{"arxiv_id":"2309.15807","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.15807","snapshot_observed_at":"2026-07-08T05:54:33.464514Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","venue":"cs.CV","work_id":"ae882a46-08bc-4ec0-a38c-72bc9eec3afe","year":2023},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2309.15807","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:1aa8337e3d02d564fae012fe89b82153b0ae6c0af83526f52616f471e326ef12","observation_id":"fa2aa916-f813-4e28-9b4f-34849fbf40f1","resolution":{"observed_at":"2026-05-11T23:31:14.407195Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":"2505.14683","doi":"10.48550/arxiv.2505.14683","metadata_source":"pith","pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emerging Properties in Unified Multimodal Pretraining","venue":"cs.CV","work_id":"e0cfd82c-f5d4-44fd-b531-ec73ab0a805b","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:72c9538f3186029d2db9e12bc60eea97377e7b96e80df34ecd9b7af1329333a9","observation_id":"25903ecf-358c-447c-b16d-6a81c8632045","resolution":{"observed_at":"2026-05-11T23:31:14.374331Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T15:42:38.298629Z","title":"In: ICLR (2021)","venue":null,"work_id":"89fb0142-6414-43cb-8074-fc92393bc74c","year":2021},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:93b3c4ce6bb288248e8106465cf36c6338e4e18e0138f3dd42a006ad12e23672","observation_id":"466d7839-3afc-4190-9224-a2c3de5df50c","resolution":{"observed_at":"2026-05-27T01:38:23.375516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:3347a08b5efc26dd9dda40b6d6509473c2df2ea314fed34375544e1abfa9ef24","observation_id":"938cac5b-cde3-4185-a996-e1af56ef9baf","resolution":{"observed_at":"2026-05-11T23:31:14.355301Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:46:29.668064Z","title":"In: ICML (2024)","venue":null,"work_id":"4477f69b-2c8b-4a97-815d-00f4b0cdfcff","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:fdf553b700dd4993a56ff0160cec66eb9ba00f2a2405a197823ec04bdf070cc5","observation_id":"412cd8c0-474f-4ade-8f72-5b8603e7b4ac","resolution":{"observed_at":"2026-05-27T01:38:23.303157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14396","last_updated":"2025-03-02T07:53:44Z","snapshot_observed_at":"2026-07-06T18:03:51.687441Z","submitted_at":"2024-04-22T17:56:09Z","title":"SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation","version":2},"cited_work":{"arxiv_id":"2404.14396","doi":"10.48550/arxiv.2404.14396","metadata_source":"pith","pith_arxiv_id":"2404.14396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation","venue":"cs.CV","work_id":"15953092-dd9e-49ae-9f72-e28fc93a6068","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2404.14396","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:395e67d71c4ff2b5b85fdc963b12d4a52f5d03a9060fa872b2d08fc583e5a3b4","observation_id":"886bb0bb-19dd-4f22-892b-51eb27cde6d6","resolution":{"observed_at":"2026-05-15T22:48:36.519178Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: NeurIPS (2023)","venue":null,"work_id":"21c9cf6c-35f1-4742-8025-41e159575382","year":2023},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:f98237c98a89348fe67a8e68bf72108d12afccea60bbe4e587d374383ec7ca2f","observation_id":"dd05ed90-a635-44bb-b98e-bd183fa3a6dc","resolution":{"observed_at":"2026-05-27T01:38:23.351888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: NeurIPS (2014)","venue":null,"work_id":"fd82a1e8-863b-4a51-8000-90685e40d53b","year":2014},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:bdb486f48672e3126ba2f97f280deddacf7a4f5017dc7c593048242cd5428756","observation_id":"b07e7362-a084-4bdf-8dd6-e3bd13c2ada1","resolution":{"observed_at":"2026-05-27T01:38:23.363965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Transactions on Circuits and Systems for Video Technology (2023)","venue":null,"work_id":"0489b0b0-896a-4828-a9ce-7b72dc1cd9c5","year":2023},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:3a2e064d205b5c6526a60079895f84168664add9a8256e0fcee7cc3c2f6b3e2c","observation_id":"2487f265-66d9-4e67-ac71-6a21dad5014b","resolution":{"observed_at":"2026-05-27T01:38:23.326571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: CVPR (2024)","venue":null,"work_id":"43496d18-1453-4d37-a121-0a76ce15c945","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:4a821e397bbf791b5488bdf6db3c553b07d5052493f5a2d13080404093054306","observation_id":"eaaf3746-fa02-4baf-a500-7c18d397a83d","resolution":{"observed_at":"2026-05-27T01:38:23.372256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: CVPR (2025)","venue":null,"work_id":"9e999040-1f4c-4799-93f5-fae2bde194e7","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:b93ee330433b470c82d52b3b1e6d5afcb310fd291e1560ab075f6fbe5d745265","observation_id":"90903038-222f-4397-91d0-f322573cb4f2","resolution":{"observed_at":"2026-05-27T01:38:23.291167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:57:53.825371Z","title":"In: NeurIPS (2020)","venue":null,"work_id":"38546b20-b41c-4a37-9ff8-15a540b73b02","year":2020},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:70e934c2860ebe8acf4d034f4ade0100705c1905b441ad80e65bc0069cd1f159","observation_id":"621afa05-e237-4d8a-aa4a-0ef898191520","resolution":{"observed_at":"2026-05-27T01:38:23.348799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: NeurIPS Workshops (2021)","venue":null,"work_id":"dde85c90-0769-44d2-bdf1-6ea799eed217","year":2021},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:cc79e6af114cbf822dcf347931f114ec3167ca20bf76c9282143042d6f2d1337","observation_id":"50b30e5e-492c-4209-bac3-f3929db4bc3f","resolution":{"observed_at":"2026-05-27T01:38:23.385717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-04T23:51:18.339338Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":"2403.05135","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-07-04T16:59:58.040795Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","venue":"cs.CV","work_id":"94248955-4bc5-4517-98a0-66224a36d865","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:9e3e4a958e4b82a816cf093109d1b88cd9086b5d3ed4bcf50e71bbdd84083d14","observation_id":"7ee3b37f-0874-49c9-9bb4-9ff8ec711a75","resolution":{"observed_at":"2026-05-11T23:31:14.230321Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06945","last_updated":"2025-09-09T10:50:30Z","snapshot_observed_at":"2026-08-04T22:55:44.250639Z","submitted_at":"2025-09-08T17:56:23Z","title":"Interleaving Reasoning for Better Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2509.06945","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06945","snapshot_observed_at":"2026-07-04T16:39:58.253188Z","title":"Interleaving reasoning for better text-to-image generation","venue":null,"work_id":"d8284b77-8931-4f0c-bf78-042627e2d030","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2509.06945","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:6f1ec3df16460c49e20941f4e1cdf69464459e5a261a54e02012bea2867bbf59","observation_id":"b890564b-ba3d-47d4-89d5-74e044db0147","resolution":{"observed_at":"2026-05-11T23:31:14.310799Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:cc73c3f660eef5974faff631f25043984690744c6c4fc2f518246f76e33f038c","observation_id":"785b158f-3276-43fb-8bd1-a331380300dd","resolution":{"observed_at":"2026-05-11T23:31:14.210187Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICLR (2015)","venue":null,"work_id":"e260bf7d-3bf8-48b4-9f3d-a6d1d0824e65","year":2015},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:d5de7658c7414ac8d9efebf6a6d8293d48a8f180517925563763b71073945559","observation_id":"1b567b6b-60ff-44ce-8671-b56d2266e451","resolution":{"observed_at":"2026-05-27T01:38:23.354733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0c9f7ed3-282a-4e4b-860d-372ea329d881","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:f7a90eebcfbe6e0bc58b1262ff6b31375d398f1790fcb36d154f257bee162ed9","observation_id":"baab5b39-edc2-4b57-b1a7-6e5a25c7668e","resolution":{"observed_at":"2026-05-27T01:38:23.334091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08268","last_updated":"2025-02-03T21:47:31Z","snapshot_observed_at":"2026-08-01T14:30:18.054312Z","submitted_at":"2024-02-13T07:47:36Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","version":4},"cited_work":{"arxiv_id":"2402.08268","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.08268","snapshot_observed_at":"2026-07-04T10:59:46.566942Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","venue":"cs.LG","work_id":"162054d2-6f8e-4dc0-87b8-ebff78210c7c","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2402.08268","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:bf291d421088dc231e9e78b167ff2204bf2115a542f47ce048946851f893e71d","observation_id":"02aacbf4-f8fe-42cd-a890-bf1b6baf1e64","resolution":{"observed_at":"2026-05-16T06:36:57.375169Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.781327Z","title":"In: NeurIPS (2024)","venue":null,"work_id":"09f9e660-8b2d-49a8-aea7-48c7d4c5ed54","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:916d825147926cf7bae5e8a66c7c54cafa8a0e8726dd81f8d38733de1d3eb477","observation_id":"9aa4180f-cbec-450b-8ded-38973bc4a312","resolution":{"observed_at":"2026-05-27T01:38:23.318961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICLR (2022)","venue":null,"work_id":"37e3a37b-2819-40c2-ae4f-a2918a4f21c9","year":2022},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:887274f5cd8e45eea47a43f1a7480632eb7576e5947f571db7d3ec23a8e575ef","observation_id":"898cf4d8-d3b4-4fa7-8d62-f51923af0c06","resolution":{"observed_at":"2026-05-27T01:38:23.360675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:46:29.666270Z","title":"In: ICLR (2019)","venue":null,"work_id":"05b03b04-21ec-40f3-bc68-547cb97dbccf","year":2019},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:f31edc35e9050d98fc151577138fdf11113e0d7bb5776785708a8ba3d518ac4e","observation_id":"516cf467-f43d-48f2-8b81-8d699fd19a60","resolution":{"observed_at":"2026-05-27T01:38:23.287490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.18639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:56:37.624881Z","title":"Understanding-in-generation: Reinforcing generative capability of unified model via infusing understanding into generation","venue":null,"work_id":"1b46b211-a8d1-4cd8-ab12-66de67326d72","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:b1fe2ff73f7736716f1d1b6a604115ce3046b3a74e4ad1dfb4d221db88599a0b","observation_id":"a9eec926-8013-43a2-ac56-5cb58c334491","resolution":{"observed_at":"2026-05-11T23:31:14.422833Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07975","last_updated":"2025-03-24T08:33:32Z","snapshot_observed_at":"2026-07-06T19:49:17.129421Z","submitted_at":"2024-11-12T17:55:10Z","title":"JanusFlow: Harmonizing Autoregression and Rectified Flow for Unified Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":"2411.07975","doi":"10.48550/arxiv.2411.07975","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.07975","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025.doi:10.48550/arXiv.2411.07975","venue":"arXiv (Cornell University)","work_id":"57d73d19-7fb3-40ec-aa67-42c6d678ec43","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2411.07975","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:0c77f56f76c35a570174b3fffbb012410c74b69f65c20f87b4c46129015c2fe1","observation_id":"a56697e3-8d02-4b0b-9224-d0adfb1bcffd","resolution":{"observed_at":"2026-05-11T23:31:14.274607Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICML (2022)","venue":null,"work_id":"51967427-79bd-474f-a017-f7d36dabf745","year":2022},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:4f94aef59ee518247333d1963996e7bb8ddf9a40c55f1273441242bed04b0d14","observation_id":"f4ca73c9-c430-42c3-86ef-de53a71b36c8","resolution":{"observed_at":"2026-05-27T01:38:23.299110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06256","last_updated":"2025-04-08T17:58:47Z","snapshot_observed_at":"2026-08-03T00:43:33.310493Z","submitted_at":"2025-04-08T17:58:47Z","title":"Transfer between Modalities with MetaQueries","version":1},"cited_work":{"arxiv_id":"2504.06256","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.06256","snapshot_observed_at":"2026-07-04T16:39:58.250680Z","title":"Transfer between Modalities with MetaQueries","venue":"cs.CV","work_id":"a89f31c1-6a3f-451e-9971-692c11219ea3","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2504.06256","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:f4167106993c298affe8619d1777875509db773a97b0ea14b2054be094888bd2","observation_id":"fab50a81-a0ea-4e40-9eb8-d3f0f37c4aa0","resolution":{"observed_at":"2026-05-14T22:49:23.311693Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:46:29.633380Z","title":"In: ICCV (2023)","venue":null,"work_id":"73b1470f-68c2-4540-ba62-6177a1e99ee2","year":2023},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:1ce90b31a44e66e29cfd609afa39274875230fb7bca1cb49aca058b7949c8fe3","observation_id":"895007c7-234e-4e51-b1e2-0ebe9eaf6ad2","resolution":{"observed_at":"2026-05-27T01:38:23.314511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICLR (2023) Refinement via Regeneration 17","venue":null,"work_id":"77721ab5-13a3-4af9-9b83-21fde45a491d","year":2023},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:9e49c0cebd368480426b7a0cbe62961f29fcf5fe1f7bfc7ecdd96d9958fae7d6","observation_id":"6a8d0e67-f515-4266-82b1-82352a3e5713","resolution":{"observed_at":"2026-05-27T01:38:23.283665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.05606","doi":"10.48550/arxiv.2508.05606","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Uni-cot: Towards unified chain-of-thought reasoning across text and vision.arXiv preprint arXiv:2508.05606","venue":"arXiv (Cornell University)","work_id":"2d7c3351-90a7-45ce-a374-890c71fbea6e","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:df76c480dd4a5374bb6a8b263002b4b70255d53b305be5a11dc5cbf069015643","observation_id":"ed897660-6b89-4114-8526-5c051de54f7e","resolution":{"observed_at":"2026-05-11T23:31:14.317354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: CVPR (2025)","venue":null,"work_id":"753d38e4-6994-425d-a39e-9c2d5cee3e9d","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:91f2f10e40a00ffda3b6968c1c7d36e84304d0e5d144e372101c2f8d44f79751","observation_id":"92298813-f783-42cc-aef0-3b5957a413aa","resolution":{"observed_at":"2026-05-27T01:38:23.310439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:34:33.019657Z","title":"In: ICML (2021)","venue":null,"work_id":"af146b19-7de3-4a7d-8651-047f4824e251","year":2021},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:a8bb8d5172fbb8a71451cb59a5db95324e8e591ac308c0bdd80d097194d3b0b9","observation_id":"a7812e24-4cb8-4ff0-8b7e-b91ae36638ac","resolution":{"observed_at":"2026-05-27T01:38:23.379441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"JMLR (2020)","venue":null,"work_id":"423648a7-5e2d-44f3-9a4c-28d1784ff321","year":2020},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:043d42108f4f2606ba59a9d1bce099d2c60280a7497891627b9e0b6dea029605","observation_id":"78c3f9b5-5a92-40c4-ad66-6feaed42b426","resolution":{"observed_at":"2026-05-27T01:38:23.271918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":"2204.06125","doi":"10.48550/arxiv.2204.06125","metadata_source":"pith","pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","venue":"cs.CV","work_id":"0c6a768b-70b8-4242-bb0e-459f1008c9fc","year":2022},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:38de9b82c7225c83b794301d50fd477ee17620161ddc45b4cab420a46b85b9c4","observation_id":"c13a2dd2-6e3e-4fc1-888c-a83931941cd8","resolution":{"observed_at":"2026-05-11T23:31:14.283171Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:57:53.496616Z","title":"In: CVPR (2022)","venue":null,"work_id":"f09753ab-b8a7-4d7b-a579-aff594de0966","year":2022},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:31ca5d86a9eb62ace4358716da71dd157946b6a3fdae86ab599e4439fb0764d5","observation_id":"88fba717-e53d-4491-ac62-e3124cc0e7c9","resolution":{"observed_at":"2026-05-27T01:38:23.344224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: NeurIPS (2017)","venue":null,"work_id":"ba145b0e-23c3-4161-ab0e-d3bfc679255e","year":2017},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:6916765d0970136b753b765fc395a3ebb0f3f05fc7b24d59a91d82adf938a521","observation_id":"92440000-655a-4ef1-a5be-2a5e7f7b8bf4","resolution":{"observed_at":"2026-05-27T01:38:23.382510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":"2405.09818","doi":"10.48550/arxiv.2405.09818","metadata_source":"pith","pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","venue":"cs.CL","work_id":"2661b9a6-25cc-41a1-8100-612d2b801289","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:d1fcab032a80c43f54bb75cfbcf173bddbca6d596b01e8184a889c92746b3953","observation_id":"a787bcc2-ac01-48d2-8504-8f1d25ab28d5","resolution":{"observed_at":"2026-05-11T23:31:14.432128Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-10T17:49:22.013335+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T17:49:22.013335+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICCV (2025)","venue":null,"work_id":"aafd6213-dc6d-4f2b-8f64-e6a9862a8097","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:078675fdc8e8cffa4fa66dd9e9d5f9d47f98edc592131f68d1cb1433bfb2a894","observation_id":"0b137f40-9d08-45c3-92c8-7758a776d24d","resolution":{"observed_at":"2026-05-27T01:38:23.306938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICML (2025)","venue":null,"work_id":"f6fab1d8-5b1a-475d-bf26-d297a685fdba","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:9c99bd44ba6909e123ca1af7282b868bb95aa4232e59aa1c703cc087a7f95284","observation_id":"58bfcd0f-040d-4bf0-bb8a-cbd367e0afac","resolution":{"observed_at":"2026-05-27T01:38:23.330377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.04545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T08:16:48.446945Z","title":"arXiv preprint:2509.04545 , year=","venue":null,"work_id":"09a3458b-cde2-4a16-8905-52e9f9c2a0ed","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:9511ef2e6d85ad19f4b56c03ecd3ee54e8397b5989ea722dc7fd866e68c775d6","observation_id":"28a2128e-f99d-4106-9dc2-b5ec8a30a8fd","resolution":{"observed_at":"2026-05-11T23:31:14.298013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":"2409.18869","doi":"10.48550/arxiv.2409.18869","metadata_source":"pith","pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emu3: Next-Token Prediction is All You Need","venue":"cs.CV","work_id":"720d288e-fac0-464c-9929-19efd9a52afc","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:ff2ab636e089a2715b0ea782a661dfe39b6b7ee4c316da0225bf23c04b8ab811","observation_id":"d8e6a60b-97cf-489a-8fcc-e3ff9c89a519","resolution":{"observed_at":"2026-05-11T23:31:14.291656Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18701","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T16:17:08.866109Z","title":"Unigenbench++: A unified semantic evaluation benchmark for text-to-image generation","venue":null,"work_id":"78a1f043-fba5-436c-8931-3398320d9ba0","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:1a179a30c66477289b56411271f678d0fd644a0bb427e8bef09839d6c49b22ec","observation_id":"f73691fb-24a9-494f-a8c1-f54689fd8e56","resolution":{"observed_at":"2026-05-11T23:31:14.224632Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:6dfd97386edc72c9a200ff7239bc8274bd365c1fdd23cdfd1ef7d9fe95e831ff","observation_id":"c9fbc888-e8a8-4844-a323-c2c72e31c3e4","resolution":{"observed_at":"2026-05-11T23:31:14.238859Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":"2410.13848","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-07-04T10:19:47.348172Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","venue":"cs.CV","work_id":"8aa59998-5ac6-4ee1-bcb4-cf7fe479058b","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:6c72b1a7178370022f4b305cee2de30e9e4ddd9c6234a47ed68bdf932a69a259","observation_id":"8ddef5ec-63a0-4b63-8234-32ae3fdc7c84","resolution":{"observed_at":"2026-05-15T22:09:16.660059Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: CVPR (2024)","venue":null,"work_id":"63d19b9d-9adb-4197-bf79-a8c56597de90","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:d626a84c1876365810d190dfd06ae0822ef5d2a0f89f223d7c47034715d312d8","observation_id":"9901447c-408e-4778-a8b0-b70e44c7671f","resolution":{"observed_at":"2026-05-27T01:38:23.322876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICLR (2025)","venue":null,"work_id":"4721665d-0d13-4822-a358-f89395ee83eb","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:6e05e55a6aa9776a9e9f7b28ea0949a9e64d3db35ca6811d41b8db25aeaaa61a","observation_id":"727da076-e1c8-4ffa-a8b7-847924a8a4b8","resolution":{"observed_at":"2026-05-27T01:38:23.357575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15564","last_updated":"2025-09-22T01:24:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T15:39:15Z","title":"Show-o2: Improved Native Unified Multimodal Models","version":3},"cited_work":{"arxiv_id":"2506.15564","doi":"10.48550/arxiv.2506.15564","metadata_source":"pith","pith_arxiv_id":"2506.15564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Show-o2: Improved Native Unified Multimodal Models","venue":"cs.CV","work_id":"77f00563-1ce6-4fba-9d4e-c8ce83f716ac","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"cited_paper":"/paper/2506.15564","citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:a0799665c02ff0f490f0f46cad788d5a21375ac19cb2f6f02021ae82b09fa966","observation_id":"f444cbed-80ae-4098-88a7-9d2761f49d28","resolution":{"observed_at":"2026-05-12T18:51:16.424084Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: CVPR (2024) 18 J","venue":null,"work_id":"d9af5a70-4530-42a7-ab1c-59bea703d18c","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:db70f00c55bb50c8a00e1aee1e69f8bceed8a3db32238c06c39b994280c44ae5","observation_id":"5946345f-37d6-4d45-a0e8-04e96b1b7ce0","resolution":{"observed_at":"2026-05-27T01:38:23.295297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ICML (2024)","venue":null,"work_id":"aed655fc-ad92-4508-b89a-cdcdd8ac4874","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:9c1e14d4e4078b66d7d578b706dba9c350cb856b8b857a0aae34294b87eded53","observation_id":"5b2bc67d-de4c-438c-abad-a07d1d24d66f","resolution":{"observed_at":"2026-05-27T01:38:23.264276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: CVPR (2025)","venue":null,"work_id":"213a4c81-d3bb-455a-814d-f772d184f4e9","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:e85658a19642de9148fde7df981bc75dde5e0a4b908a7cf2d6222b65a08cad6e","observation_id":"2a71cecb-7568-411d-af13-5b903aab4987","resolution":{"observed_at":"2026-05-27T01:38:23.369243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: NeurIPS (2023)","venue":null,"work_id":"d0855a5a-ee73-43b0-b2d9-170240f0aa28","year":2023},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:51cc73fade7bba773fac28e70cc024f805e05ec83a02c45ea9c3d8d64af00280","observation_id":"e6e589ea-a24a-4b02-966c-ee2bfdac3b4d","resolution":{"observed_at":"2026-05-27T01:38:23.341233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: NeurIPS (2024)","venue":null,"work_id":"ec69f03d-0c60-4276-b45e-f187058d56b5","year":2024},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:9d4908ee339e43d28d9594937ae43c12dbf2e161da69ecaedbbecf8cf5d9c57d","observation_id":"2a2ec9d8-df88-41aa-ac43-bea1a4525eb6","resolution":{"observed_at":"2026-05-27T01:38:23.276763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"043a3fea-6377-4eb9-a4b1-d79deae832b9","year":2025},"citing_paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.763050Z"},"links":{"citing_paper":"/paper/2604.25636"},"observation_digest":"sha256:b18b46b5e17f50a3ff4013a49dedce3fdb7ce9cbe5b2de1199e4222e751f5299","observation_id":"4d426fa5-d99a-40ef-9858-2fb0405647df","resolution":{"observed_at":"2026-05-27T01:38:23.337876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.25636","last_updated":"2026-04-28T13:36:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:36:03Z","title":"Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":21,"parse_uncertain":0,"unresolved":2,"verified_exact":6,"verified_fuzzy":33},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2604.25636."}