{"as_of":"2026-08-07T16:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aee13d43e1672d53ddfea85efc67872fdbe5f08dc573ed35793f419f009a0add","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:30:27.240877Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:54:24.937137Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:39:51.542556Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"cited_work":{"arxiv_id":"2506.07963","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07963","snapshot_observed_at":"2026-07-04T13:39:51.542556Z","title":"Reinforcing multimodal understanding and generation with dual self-rewards","venue":null,"work_id":"270a7335-8aca-4660-a34a-625b9b71dff3","year":2025},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-08-06T15:38:05.011922Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":197,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2506.07963","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:1a85a66cad0a61726de6fa57554ca8a36a6d20b1b55a2b47a394e7765073fde3","observation_id":"2fe94ad2-fdfa-4a8c-9c70-8019974e7869","resolution":{"observed_at":"2026-05-18T00:05:31.604172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07963","snapshot_observed_at":"2026-08-04T09:54:24.937137Z","title":"Reinforcing mul- timodal understanding and generation with dual self-rewards.arXiv preprint arXiv:2506.07963,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12784","last_updated":"2026-06-28T11:09:54Z","snapshot_observed_at":"2026-08-04T09:54:23.338683Z","submitted_at":"2025-10-14T17:56:11Z","title":"SRUM: Fine-Grained Self-Rewarding for Unified Multimodal Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T09:54:24.937137Z"},"links":{"cited_paper":"/paper/2506.07963","citing_paper":"/paper/2510.12784"},"observation_digest":"sha256:1416a14c4d2cdb866f36bf3450fd77dc01c61ce88790a3547c6e75635711d8a1","observation_id":"7b72bc66-ff7d-4a96-9026-21567ceda278","resolution":{"observed_at":"2026-08-04T09:54:24.937137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"cited_work":{"arxiv_id":"2506.07963","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07963","snapshot_observed_at":"2026-07-04T13:39:51.542556Z","title":"Reinforcing multimodal understanding and generation with dual self-rewards","venue":null,"work_id":"270a7335-8aca-4660-a34a-625b9b71dff3","year":2025},"citing_paper":{"arxiv_id":"2606.27376","last_updated":"2026-06-25T17:59:57Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:59:57Z","title":"Ask, Solve, Generate: Self-Evolving Unified Multimodal Understanding and Generation via Self-Consistency Rewards","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T04:58:15.891214Z"},"links":{"cited_paper":"/paper/2506.07963","citing_paper":"/paper/2606.27376"},"observation_digest":"sha256:87430219eaa079fc2a42c730fc432b24c3ee48c9bd38795f57109454b1fcac91","observation_id":"f617798e-60c8-40fd-88a7-fcdb4c02904d","resolution":{"observed_at":"2026-07-04T13:39:51.544735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07963/citation-record","integrity":"/paper/2506.07963/integrity","json":"/paper/2506.07963/citation-record.json","paper":"/paper/2506.07963"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.192900Z","title":null,"venue":null,"work_id":"a75b9e3b-3de0-4313-aab6-8da5a2b9ef70","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.928846Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:038a05b01863537687afeebd295bdb2d19b4c1b35a0ab27cf25e76743429c1ba","observation_id":"34e31048-d3a1-4dbf-9d6a-5892834d9ee3","resolution":{"observed_at":"2026-08-07T05:30:28.197768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T05:30:26.934199Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.934199Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:6fae306893b3b28a4fe45763bd7b283a52cb4380a7231c19abb106a1f03a7c1e","observation_id":"030bf8b5-b31c-4f67-a578-be7f28a15ce5","resolution":{"observed_at":"2026-08-07T05:30:26.934199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T05:30:26.939490Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.939490Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:fdaf21a60b8055a90f6820cf8bcbf66edef5ccc061f6a7d88cfa1d26305a3132","observation_id":"476e7ccf-7c3a-451d-a10d-6cbd6e7fccfb","resolution":{"observed_at":"2026-08-07T05:30:26.939490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:26.944775Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.944775Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:99d3d804e6e06d4e8298926f71f74f85e03d46c30de2485ee1ae72b748bf6de6","observation_id":"bb092b5f-e680-4bca-ad89-a86b000b4bd7","resolution":{"observed_at":"2026-08-07T05:30:26.944775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.167907Z","title":null,"venue":null,"work_id":"7abfef44-bae4-4bce-ae3b-125e858b963f","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.949807Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:5c74529c47f5b125b1878552af083f5ab4ced62f4ee57e994485eb9bdafde6b7","observation_id":"39545832-955e-442e-8d82-e5ce221c45f4","resolution":{"observed_at":"2026-08-07T05:30:28.173054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.153846Z","title":null,"venue":null,"work_id":"5f0ba7b4-0013-49a0-8364-8b5d18e6074b","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.954721Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:1f0834b153ec97610c3cb35d57143ed909ccdb1dfe3e4280c95f415fb99242bf","observation_id":"f5695d3b-42fe-4661-9800-339c91ac2dba","resolution":{"observed_at":"2026-08-07T05:30:28.158281Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-07T05:30:26.960872Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.960872Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:de79f57ef66f216b38ea971c36298151a9fcae0b247a1057d7777b6a7fb518e1","observation_id":"f66c0f2e-a84a-4991-b9ed-9f51a6d12c29","resolution":{"observed_at":"2026-08-07T05:30:26.960872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.139272Z","title":null,"venue":null,"work_id":"19c82da5-7500-41f6-b069-f1a5d5fe2c51","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.965722Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:b750ed93201f5d797166067494abd4f2efe9b92d6ca4cd97871570b955b2b2be","observation_id":"b9fda4c4-1c7e-457c-9ebd-83b4312d8a5a","resolution":{"observed_at":"2026-08-07T05:30:28.144043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.124209Z","title":null,"venue":null,"work_id":"8a0710ba-dcac-468d-aac3-176e40b42900","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.971313Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:86c5277d467a2d024572f53007ed367d323c27fb83a5c534f3aed4eb7818d08b","observation_id":"6f8447af-42b3-4a09-9334-d6f56246f97a","resolution":{"observed_at":"2026-08-07T05:30:28.129436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.108219Z","title":null,"venue":null,"work_id":"ebce2169-7c58-4308-a440-3e869e681ec1","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.975940Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:ea0cb9558be74bab7f420a1abe5645f4782c2726ef68c33680564e9acd6482d7","observation_id":"5e2e6c19-fee8-4a54-aaa2-8aa0b24ca236","resolution":{"observed_at":"2026-08-07T05:30:28.113226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.092243Z","title":null,"venue":null,"work_id":"b1006391-ae3a-435a-9963-ad56918fcc82","year":2021},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.980833Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:917713263cb69a93081538bb06f44ec5084be4f5561768baf69c8cbbdfab358f","observation_id":"66ffc0c5-a7e5-4aea-9ed5-6e0e1b0cb54a","resolution":{"observed_at":"2026-08-07T05:30:28.096940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05032","last_updated":"2023-02-28T23:46:24Z","snapshot_observed_at":"2026-08-04T03:38:52.868510Z","submitted_at":"2022-12-09T18:30:24Z","title":"Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05032","snapshot_observed_at":"2026-08-07T05:30:26.985271Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.985271Z"},"links":{"cited_paper":"/paper/2212.05032","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:639cf3fb688d88f88520523eacd97d86ea785f1883e907c46aa17fca6754d6b4","observation_id":"c05877b1-550a-4e8b-b27c-de10ba4401f1","resolution":{"observed_at":"2026-08-07T05:30:26.985271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14396","last_updated":"2025-03-02T07:53:44Z","snapshot_observed_at":"2026-07-06T18:03:51.687441Z","submitted_at":"2024-04-22T17:56:09Z","title":"SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14396","snapshot_observed_at":"2026-08-07T05:30:26.990200Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.990200Z"},"links":{"cited_paper":"/paper/2404.14396","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:0d713d7cbe9459670b19c4230e0a269796917215d61bc7ac56ebab52b46f25e6","observation_id":"049a9ad0-4ba2-479a-a5f7-faee30561381","resolution":{"observed_at":"2026-08-07T05:30:26.990200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.077194Z","title":null,"venue":null,"work_id":"7982d417-8de2-43cc-9b62-4023322e2dab","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.994948Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:01a4bee2cd38a6adb11ca198c51c8e4eaa2baa502b1bbb0fc391584f014ee934","observation_id":"9549833c-2741-48fd-bcd2-f517171612cf","resolution":{"observed_at":"2026-08-07T05:30:28.081911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.062321Z","title":null,"venue":null,"work_id":"cdccb995-b707-43e0-906e-13b90e9347c3","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.000145Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:60b98dc6284a0531c350aaab91420bd841ceb87e8f64651a4e590c3aa8cd3cea","observation_id":"152d9bfd-1b77-45e7-81d2-df9a777c97be","resolution":{"observed_at":"2026-08-07T05:30:28.067245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.047721Z","title":null,"venue":null,"work_id":"9b7d2e35-5f16-4585-ae04-00d875a33eb9","year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.005060Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:99ee956ed563f1d4c229eb5b941838901db924f69d8378df239a5191e2f31de2","observation_id":"b8526ddb-73f2-469d-adfb-ae8cb4489e75","resolution":{"observed_at":"2026-08-07T05:30:28.052371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00703","last_updated":"2025-07-01T11:46:57Z","snapshot_observed_at":"2026-08-07T15:57:18.894741Z","submitted_at":"2025-05-01T17:59:46Z","title":"T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00703","snapshot_observed_at":"2026-08-07T05:30:27.014921Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.014921Z"},"links":{"cited_paper":"/paper/2505.00703","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:389223bb61f97e08e7cf577a2d0d258c8a33e581d0512a7c5f78dda94939fdc2","observation_id":"178dfa81-561c-42dd-8a3c-99f3cbd1dca0","resolution":{"observed_at":"2026-08-07T05:30:27.014921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.032803Z","title":null,"venue":null,"work_id":"de61b8ed-6a83-4b52-931e-28edc3ce181f","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.019805Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:142996aede335c8853d6356c6e47e157504d87be828baf29551f60735fa5b11a","observation_id":"e11f9d04-2253-495d-a522-fc5df98a9761","resolution":{"observed_at":"2026-08-07T05:30:28.037690Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.024116Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.024116Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:53563efa9e7b7b48c9df6d534cd0825c4743baa90aa0161a798d09e179c33ea7","observation_id":"1916b5cd-270c-4049-9fe7-74bbef8778db","resolution":{"observed_at":"2026-08-07T05:30:27.024116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.028909Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.028909Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:fddca82173749900d1485cb50089cbd8a6b320d97cafdc38854f2d5ff04a6a88","observation_id":"0e05fe86-6b9a-404b-bac2-c61e4d0707ee","resolution":{"observed_at":"2026-08-07T05:30:27.028909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T05:30:27.033266Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.033266Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:fb1808e28eb12b15152e87c7b9544a1d2e283c25240b40b128a7c76cc289237f","observation_id":"01e38c16-6906-4a5d-964b-345271d45717","resolution":{"observed_at":"2026-08-07T05:30:27.033266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.998589Z","title":null,"venue":null,"work_id":"45041528-8335-4a53-a3b0-ff9695da100a","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.037679Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:bc053e2cfc7e7a3b45f7dfa3d2805433a222959a29923e460dd4322463b3ab1f","observation_id":"effd4c6d-cb0a-460d-abea-bc7c97d5b6e5","resolution":{"observed_at":"2026-08-07T05:30:28.003881Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00289","last_updated":"2025-04-01T19:09:34Z","snapshot_observed_at":"2026-07-06T20:15:03.658292Z","submitted_at":"2024-12-31T05:49:00Z","title":"Dual Diffusion for Unified Image Generation and Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00289","snapshot_observed_at":"2026-08-07T05:30:27.042171Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.042171Z"},"links":{"cited_paper":"/paper/2501.00289","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:109ac111eee79ff446718ced8006357c08a1e0ff8e9528bbc25b0c0f8820bfa9","observation_id":"b74913d7-a687-49da-bcfd-170f68407a83","resolution":{"observed_at":"2026-08-07T05:30:27.042171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.047061Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.047061Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:2e0326c9ba2e417dfb7546896a22fc7aa27a41acc8d6d045c83eb6b221b5e199","observation_id":"e153f12d-2664-414a-812b-58be4ac2903f","resolution":{"observed_at":"2026-08-07T05:30:27.047061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.051526Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.051526Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:a538b035723b3e10e13bb05962031079d7d4b464a945c4da475d7e2cfa830b9b","observation_id":"62d1c41c-1cf1-4d21-a775-9b18b17991ff","resolution":{"observed_at":"2026-08-07T05:30:27.051526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.056021Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.056021Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:0e8963d14ffa2df94950282f4f27c6854b995d2265be94083c3d0da73f671209","observation_id":"c98c7cb2-aeaa-4896-8cef-475a5211411e","resolution":{"observed_at":"2026-08-07T05:30:27.056021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.956020Z","title":null,"venue":null,"work_id":"3d67ef20-d725-4adc-b5ec-1ea613db54a2","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.060265Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:7584f5fbac282cb9530c5ce54f183349b286d36243647d69ba22bb46e312351e","observation_id":"5126711a-d8f7-42b9-a1ab-4f7d04482d9b","resolution":{"observed_at":"2026-08-07T05:30:27.960574Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.941242Z","title":null,"venue":null,"work_id":"03ca63b4-1585-424e-b6ff-6d21a6359539","year":2022},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.065128Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:ea572f9e08e198034b11780fb98d52647f7e80d0e02efd38ad0cb1f09d35b01c","observation_id":"6cc3d5e4-6c41-4baa-b85a-b035356585b0","resolution":{"observed_at":"2026-08-07T05:30:27.945919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.926571Z","title":null,"venue":null,"work_id":"3f5072a1-d8d4-41ba-82f2-723878282617","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.069704Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:226c6facb9c1ac285ddd1ae5918357451fe8a218631ea9c9c90a1e992adfa9ed","observation_id":"83a12574-4bac-483a-94b9-b89428aeec13","resolution":{"observed_at":"2026-08-07T05:30:27.931317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-05T16:51:32.094151Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-07T05:30:27.074181Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.074181Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:6730af878d25452bd82e2a1eb903d8d4a758052e5343514558ffac4e7710efd6","observation_id":"27be12df-04bf-49ef-a6dd-9370d2b9bd23","resolution":{"observed_at":"2026-08-07T05:30:27.074181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.911808Z","title":null,"venue":null,"work_id":"d60187d1-d24c-458b-9896-86a709152a57","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.078965Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:b43fbb68677659e3b4dcf53e38d9f8b568e5606c38f39525f27f6e7738ccb9f3","observation_id":"b416e6a3-2ec0-43c8-b9e5-f6ae9822a562","resolution":{"observed_at":"2026-08-07T05:30:27.916308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.083321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.083321Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:1860b112e89b4b92a015d70491485595d6379e67c3198406f137f4f8f36d8f0b","observation_id":"72e653b7-f105-4d20-ba0d-a85145ae492d","resolution":{"observed_at":"2026-08-07T05:30:27.083321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.888809Z","title":null,"venue":null,"work_id":"10000659-f40e-400c-a04f-6a12aad7c35b","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.088748Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:5887690deb2ab418f99b8020d8bef6eb915c1fcb8f321887a34542d37b830097","observation_id":"07f768bd-9e98-4005-90c1-90ed1f1de104","resolution":{"observed_at":"2026-08-07T05:30:27.893081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.874269Z","title":null,"venue":null,"work_id":"b0c90da0-7d96-4476-9311-a499adfa113a","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.093709Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:72e514ab9214f4d7fb96881e1cc392ea058edcb8504ae3c8f03a5eaf435ed009","observation_id":"3dff539c-e43e-4b39-a19c-e752418731de","resolution":{"observed_at":"2026-08-07T05:30:27.878873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T05:30:27.098652Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.098652Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:abdec7c0a39c6af50bcd463057cf8862883bd471ed635a41ecf0c6498a64d5d4","observation_id":"1fd6c9af-f1c7-4e89-b4c3-9437bf9f51e2","resolution":{"observed_at":"2026-08-07T05:30:27.098652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05818","last_updated":"2025-03-24T23:22:02Z","snapshot_observed_at":"2026-08-06T18:36:49.006701Z","submitted_at":"2024-12-08T05:28:08Z","title":"SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2412.05818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05818","snapshot_observed_at":"2026-08-07T05:30:27.496049Z","title":"SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation","venue":"cs.CV","work_id":"d802f4af-7487-41f2-b805-9e3a96190a2c","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.103280Z"},"links":{"cited_paper":"/paper/2412.05818","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:15d1e784b63a2b9d6bef45a6132d3858f979d3de85aaa1f24418260807cebf87","observation_id":"a6bdf839-3534-404d-a26d-b0076853d7a6","resolution":{"observed_at":"2026-08-07T05:30:27.503745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.860156Z","title":null,"venue":null,"work_id":"fd6e1542-c77f-47c2-8005-47879ad7fa77","year":2021},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.107881Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:a2623a936d2731780bb1d46c5d7d2830ef9c6d5e950bee42f402b1fcaa9bbe2e","observation_id":"b677b4c3-48ab-4d87-847f-422ddf6996c3","resolution":{"observed_at":"2026-08-07T05:30:27.864651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.112713Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.112713Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:307173a20920d11cd2cf56b10a9f61c3b8b43587bacbd2e4e53ca6545602955f","observation_id":"48cd6510-b10f-4df2-b7f5-8c3075e3e33c","resolution":{"observed_at":"2026-08-07T05:30:27.112713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.117606Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.117606Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:4a8102ad858aba24af6153a41da42f1e36d7d54e9445105c6beb1d6da5d3d31f","observation_id":"e28f5d81-0f6a-46fb-bf91-c583282c3836","resolution":{"observed_at":"2026-08-07T05:30:27.117606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.826862Z","title":null,"venue":null,"work_id":"9c724756-fb11-4692-8d30-502ea6b2bbe3","year":2022},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.126900Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:3859ce0535c6c5b96651d0fd6c5f61473e13b97d01e179a2138eea86bb41790e","observation_id":"5fe7815c-4c28-4f19-9bb1-148063d24c0e","resolution":{"observed_at":"2026-08-07T05:30:27.831519Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T05:30:27.131912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.131912Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:1f3d4c16f2de845a6a274ef9fb2b0d4f47449e863327b8b13d070f52c1c14426","observation_id":"3628d465-384c-40c4-b3fb-ec01a9a60451","resolution":{"observed_at":"2026-08-07T05:30:27.131912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.812199Z","title":null,"venue":null,"work_id":"86f1cfff-43a0-4a00-a430-e290f2bc0e9a","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.137164Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:974d095ebbffe8f987ffd703c3b0f50d59745c621099a21b8d5e9bf1ac584495","observation_id":"d83006e3-c772-498c-a0c0-28521e5da2bc","resolution":{"observed_at":"2026-08-07T05:30:27.816871Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.797038Z","title":null,"venue":null,"work_id":"e220109d-972c-4713-8cb9-3ff99cf1833a","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.142267Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:05f8e28febf4edfd1fb09054768cc1a1844e7d38cc0db0d75cf0d5f7c5531771","observation_id":"4d50a96b-3af2-4a9c-834d-43bea0ecca57","resolution":{"observed_at":"2026-08-07T05:30:27.801911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T05:30:27.146722Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.146722Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:919a53c739b16e510b3e8b2516d6d4203b5d4d1648cde36535f2a0a36ac64b70","observation_id":"8903f20c-529f-4f42-a8b1-ed7715ef63b0","resolution":{"observed_at":"2026-08-07T05:30:27.146722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.151759Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.151759Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:f93cbc647a446549e8a9b17646eca570ab2a44540d35531167383ddb9bca6692","observation_id":"d61d2a31-dcf0-4c6a-b518-06fcf2588a83","resolution":{"observed_at":"2026-08-07T05:30:27.151759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.771771Z","title":null,"venue":null,"work_id":"ee67b481-de52-40d8-9e8c-a87dbb6659e1","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.156139Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:791e0aecb45ae3236f776b56af145484fa9ca4551d548ec195c012fee60d4d3f","observation_id":"0e3b3c1a-db97-4757-affb-f25f766bf9bc","resolution":{"observed_at":"2026-08-07T05:30:27.776772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.756478Z","title":null,"venue":null,"work_id":"ea998b9d-c494-4eaa-a054-269217a4794a","year":2017},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.160476Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:9cd70a91a1035adaf5d2a9a436ac29da7fad28d59470e63b67a192debaf0a07e","observation_id":"89edf2a4-b34e-4127-8ac3-2f4475933e0d","resolution":{"observed_at":"2026-08-07T05:30:27.761861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06673","last_updated":"2024-12-09T17:11:50Z","snapshot_observed_at":"2026-07-06T20:04:01.034597Z","submitted_at":"2024-12-09T17:11:50Z","title":"ILLUME: Illuminating Your LLMs to See, Draw, and Self-Enhance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06673","snapshot_observed_at":"2026-08-07T05:30:27.164874Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.164874Z"},"links":{"cited_paper":"/paper/2412.06673","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:91b35f7c69aa54b6d557f12957b6e2c77b48d3e232a82347d0544a59ddead0f6","observation_id":"55b058cf-fc10-4d8d-8c92-7e0ebf2249d5","resolution":{"observed_at":"2026-08-07T05:30:27.164874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11455","last_updated":"2025-04-15T17:59:46Z","snapshot_observed_at":"2026-08-07T16:02:04.272189Z","submitted_at":"2025-04-15T17:59:46Z","title":"SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11455","snapshot_observed_at":"2026-08-07T05:30:27.169774Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.169774Z"},"links":{"cited_paper":"/paper/2504.11455","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:6200f6285e87822b6c7533e6d72dfcb59938c5eb561c81624884c6a7a66b08fa","observation_id":"1df0a6a2-8f98-49df-a235-21116094180c","resolution":{"observed_at":"2026-08-07T05:30:27.169774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-07T05:30:27.174501Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.174501Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:7e513d4bb13f3683ac92c844aa723d36f4239b0bd780a9663d32028f44d04747","observation_id":"3250fd9a-198b-4e96-ab3b-6c82dbca1af2","resolution":{"observed_at":"2026-08-07T05:30:27.174501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-07T05:30:27.178910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.178910Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:1d952e18871225f7bb4c9bd095075d51aec77f3d2dbbb75ff7ba7f1a3bd33243","observation_id":"8a602248-88e9-4179-af84-35c9e7f88507","resolution":{"observed_at":"2026-08-07T05:30:27.178910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.739235Z","title":null,"venue":null,"work_id":"763b5b50-a12b-4815-a679-463d34b178c3","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.183828Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:80c6318b86877dd46389f81bb545776ac358b9a95b42d15e88183ba3e2b86586","observation_id":"ca31300d-1de9-4318-b41e-fbd39d46a64b","resolution":{"observed_at":"2026-08-07T05:30:27.744102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-07T05:30:27.188204Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.188204Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:3dc51c1616cca59c9c7b244d823a632397e5391ba4b5df8b7331350c141284f5","observation_id":"94835a3c-4fb9-4b76-aa5d-61e8fcc7bc79","resolution":{"observed_at":"2026-08-07T05:30:27.188204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T05:30:27.192673Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.192673Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:9b52893b2f835b2115c61fba2e911b35e9b9349cf2498adfeaccbddaf719fb62","observation_id":"3b852fb8-cf91-4dbd-8c73-f0113944ef29","resolution":{"observed_at":"2026-08-07T05:30:27.192673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-07T05:30:27.197315Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.197315Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:afa68e862e12ae098909354e34361e33df2cccdc931b682de595c61903ee0675","observation_id":"f81772fb-3b25-4026-8d2a-e621ad33bdac","resolution":{"observed_at":"2026-08-07T05:30:27.197315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19335","last_updated":"2024-05-29T17:59:58Z","snapshot_observed_at":"2026-08-01T16:34:38.923197Z","submitted_at":"2024-05-29T17:59:58Z","title":"X-VILA: Cross-Modality Alignment for Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19335","snapshot_observed_at":"2026-08-07T05:30:27.201831Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.201831Z"},"links":{"cited_paper":"/paper/2405.19335","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:49567ac9eacade9bd730062dad6c412a595a3baf0982f639ca90fad5d671db1f","observation_id":"3ba61ad1-768a-456e-a447-82f18c302af3","resolution":{"observed_at":"2026-08-07T05:30:27.201831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.724989Z","title":null,"venue":null,"work_id":"ace352f5-c31b-41d8-b679-d2cfafa2632e","year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.207074Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:1f0ad7e6f3e15e8ca399ce87653aa24b88ef8a3896d3801d0d401756ca18c753","observation_id":"4124d818-2734-43a4-84d0-a5b0249efae7","resolution":{"observed_at":"2026-08-07T05:30:27.729510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.710237Z","title":null,"venue":null,"work_id":"be93459a-0cc5-4ea9-826b-9db3c6c57b1d","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.215968Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:d6dcd5d232f32db085f682b142b2d26da85a3f264ef50f849a99b06f4f4c37b7","observation_id":"63e370f3-1875-452c-a273-bd578bf6d1e1","resolution":{"observed_at":"2026-08-07T05:30:27.715018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.694793Z","title":"Ma, Simon Stepputtis, Deva Ra- manan, Russ Salakhutdinov, Louis-Philippe Morency, Katia P","venue":null,"work_id":"1e9519c5-b208-47c3-a987-1a3b114900d7","year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.220358Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:0d29df178cc5a461dba45d2c2bd0fe9075aa6ebd6deecdbb8bbd1f125b3b927a","observation_id":"2bf5185c-f9e2-4da1-8942-3f2e49ad5ced","resolution":{"observed_at":"2026-08-07T05:30:27.699828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12216","last_updated":"2025-06-03T17:02:25Z","snapshot_observed_at":"2026-08-07T16:01:44.170215Z","submitted_at":"2025-04-16T16:08:45Z","title":"d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12216","snapshot_observed_at":"2026-08-07T05:30:27.225291Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.225291Z"},"links":{"cited_paper":"/paper/2504.12216","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:b109a3ae755d08a74e9dc3ab5b50ca81ee3dd152509f7358635f88ea666a3e89","observation_id":"0b9288bf-20e8-44f4-9836-6d28f7abcf2e","resolution":{"observed_at":"2026-08-07T05:30:27.225291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-07-06T16:53:51.485946Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-07T05:30:27.230749Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.230749Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:1191db7a7a52e6dd640513f3ccead216b5f84639ab062f7f404aca1d5026ff0d","observation_id":"ff90e7cc-102a-4ecf-8603-1ea2061cff47","resolution":{"observed_at":"2026-08-07T05:30:27.230749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-07T05:30:27.235770Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.235770Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:27585634158d90ec0385ece5c49e6229dee470de622f4ce7022438198ebf15ec","observation_id":"4b54aed6-a1ab-4e57-8c64-3aa90cfc3690","resolution":{"observed_at":"2026-08-07T05:30:27.235770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.680174Z","title":"M\" and an","venue":null,"work_id":"0387d3d5-b277-48f6-82df-bc90c0b7bd6a","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.240877Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:706454765caa7368caf3d3f8a988aad473c145b7e30f1bc5e25d4c316cc8aa61","observation_id":"cf990229-2d9f-4505-b12e-178a493f4849","resolution":{"observed_at":"2026-08-07T05:30:27.684850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T05:30:27.122335Z","title":"arXiv preprint arXiv:2204.06125 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.122335Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:fb3a665d98117f668484c40a28144028bb04c1dd83274ba81046ae85a2a3ad75","observation_id":"8d0e7ef2-0718-41e0-8959-14284f5f9385","resolution":{"observed_at":"2026-08-07T05:30:27.122335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15838","last_updated":"2024-12-30T07:27:58Z","snapshot_observed_at":"2026-07-06T20:10:51.514813Z","submitted_at":"2024-12-20T12:27:16Z","title":"Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15838","snapshot_observed_at":"2026-08-07T05:30:27.009844Z","title":"arXiv:2412.15838 [cs.AI] https://arxiv.org/abs/2412.15838","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.009844Z"},"links":{"cited_paper":"/paper/2412.15838","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:6696ec8c53b253c5579e1aa541d45502474c0d3c538dff94a122ce96168f34ee","observation_id":"41965ca6-c991-4de9-88d5-55ec184c603d","resolution":{"observed_at":"2026-08-07T05:30:27.009844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T05:30:27.211480Z","title":"arXiv:2503.14476 [cs.LG] https://arxiv.org/abs/2503.14476","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.211480Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:752b048984d45d8fe8b4f99e445a11ca51dabd6a920cc66812be9bfa02413fcb","observation_id":"1605fb19-019b-4012-bcce-2f1da7f47d0e","resolution":{"observed_at":"2026-08-07T05:30:27.211480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T16:19:14.303147Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 3 inbound Pith citation observations for arXiv:2506.07963."}