{"as_of":"2026-08-11T06:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e0f31f48a473a4743e5b0049364de4d11f075c32ef90c6df9de582ffe1f293b6","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-05T11:32:38.636335Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T04:57:36.109021Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.18518","snapshot_observed_at":"2026-08-02T04:57:36.109021Z","title":"arXiv preprint arXiv:2604.18518 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13527","last_updated":"2026-07-15T07:26:05Z","snapshot_observed_at":"2026-08-05T04:43:47.810355Z","submitted_at":"2026-07-15T07:26:05Z","title":"VGIF-Score: Interpretable and Diagnostic Evaluation of Spatio-Temporal Instruction Following in Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T04:57:36.109021Z"},"links":{"cited_paper":"/paper/2604.18518","citing_paper":"/paper/2607.13527"},"observation_digest":"sha256:dbaaa0da6e1f1c245cea5c82c408bbed700a96a84c022807623137dcd8fc9766","observation_id":"3d15d22c-22fd-45d9-a6d9-068d409238b0","resolution":{"observed_at":"2026-08-02T04:57:36.109021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.18518","snapshot_observed_at":"2026-08-01T17:41:02.166858Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17572","last_updated":"2026-07-25T08:59:31Z","snapshot_observed_at":"2026-08-03T13:23:48.122079Z","submitted_at":"2026-07-20T05:30:40Z","title":"JAGG: Jacobian-Aggregated Group Gradient for Efficient GRPO Training of Diffusion Models","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-01T17:41:02.166858Z"},"links":{"cited_paper":"/paper/2604.18518","citing_paper":"/paper/2607.17572"},"observation_digest":"sha256:46383406efc57e828d3e5a37ccba2e93f0dbe79252795a5b9d370f9c759ae8f6","observation_id":"50e745f9-0b7f-49ca-8b64-8b9f8b5e197f","resolution":{"observed_at":"2026-08-01T17:41:02.166858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.18518/citation-record","integrity":"/paper/2604.18518/integrity","json":"/paper/2604.18518/citation-record.json","paper":"/paper/2604.18518"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:36:07.226215Z","title":"write newline","venue":null,"work_id":"8481976a-f196-4822-833d-e487ae5a1e81","year":null},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:4d094d47de344af024f11c08668db247678cca3183b3d6333f75786baa7fcccd","observation_id":"cb0c44a9-7a71-473d-8e6d-cf8f71918e3e","resolution":{"observed_at":"2026-07-05T11:41:03.244801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.245458Z","title":"D., Ho, J., Tarlow, D., and Van Den Berg, R","venue":null,"work_id":"f840b50f-f2f0-41a4-9017-152c5aafc8d6","year":2021},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:7b14fa22fbc3ed6ed8158c37b9963ae846c6dc6eab18f9719504d8c39ebbc83a","observation_id":"9b9d4042-14be-4dea-b1c5-7cdd5635e7ed","resolution":{"observed_at":"2026-07-05T11:41:03.246692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.247547Z","title":"Meissonic: Revitalizing masked generative transformers for efficient high-resolution text-to-image synthesis","venue":null,"work_id":"4789f4e8-e2ae-4fc3-a2f3-1602534ee97f","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:dff2af5e37db1c7015fdc1a7363d210398ef2c0d5bf6e83c735a0a0147df07e6","observation_id":"ab1e2d61-29db-4d9a-95c5-b0c3d3027d31","resolution":{"observed_at":"2026-07-05T11:41:03.249053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2305.13301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-07-08T19:25:32.506868Z","title":"Training Diffusion Models with Reinforcement Learning","venue":"cs.LG","work_id":"67684dda-3930-452a-b91a-36cbb8e2e219","year":2023},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:147a8cc76663307a673891a0dd12acb0fb60abb9bbeab4ace533f9ada313c5e1","observation_id":"6882a1a8-5c97-4e5e-a449-bd959d409a9b","resolution":{"observed_at":"2026-07-05T11:41:02.703395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.285872Z","title":"Video generation models as world simulators","venue":null,"work_id":"8a298adb-2115-42f0-a6fb-82246f942e25","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:f7e54b844ef063b7eb378bf9f7ef8ef53d7310f71680f72aaac43e4ca4e2958d","observation_id":"22695962-c0ef-48c1-a953-bc06483c924c","resolution":{"observed_at":"2026-07-05T11:41:03.287586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.268347Z","title":null,"venue":null,"work_id":"842f5fdc-1d31-4c7d-b3dd-b07c39f78821","year":2022},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:5df7690fc2019b0f71767ee589d8e83ef1eb78ffa441e5bca09a06805141a886","observation_id":"70fc3d91-0db1-4a37-90bc-f00a097725d3","resolution":{"observed_at":"2026-07-05T11:41:03.269624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00704","last_updated":"2023-01-02T14:43:38Z","snapshot_observed_at":"2026-08-03T00:33:47.397969Z","submitted_at":"2023-01-02T14:43:38Z","title":"Muse: Text-To-Image Generation via Masked Generative Transformers","version":1},"cited_work":{"arxiv_id":"2301.00704","doi":"10.48550/arxiv.2301.00704","metadata_source":"pith","pith_arxiv_id":"2301.00704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Muse: Text-to- image generation via masked generative transformers","venue":"cs.CV","work_id":"ad8925f8-72d8-4ac4-88b8-027e08b46103","year":2023},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2301.00704","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:6b5c4fc77138e382f26e768c461a6ea17b5fd2453fa3147036b9202ab1824425","observation_id":"7d97494e-1a26-412c-a643-e19525e82873","resolution":{"observed_at":"2026-07-05T11:41:02.733153Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.26583","last_updated":"2025-10-30T15:11:16Z","snapshot_observed_at":"2026-08-11T01:57:48.271968Z","submitted_at":"2025-10-30T15:11:16Z","title":"Emu3.5: Native Multimodal Models are World Learners","version":1},"cited_work":{"arxiv_id":"2510.26583","doi":"10.48550/arxiv.2510.26583","metadata_source":"pith","pith_arxiv_id":"2510.26583","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emu3.5: Native Multimodal Models are World Learners","venue":"cs.CV","work_id":"518b061e-87a3-45f9-8419-30a14d89b122","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2510.26583","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:0eeb02ce8c047951a375e4063c149e8ba3c1ca89250805839cee1feb7fc5ad6c","observation_id":"0a6cd5dd-dda3-41c9-b163-87feb64903e3","resolution":{"observed_at":"2026-07-05T11:41:02.738836Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:30.986785+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:30.986785+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.262187Z","title":"Prdp: Proximal reward difference prediction for large-scale reward finetuning of diffusion models","venue":null,"work_id":"a418bc31-af23-4418-91df-212ec4823c79","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:51ea094f3abbae346e2e29792c87555c6873d65fbc8086ad661e02ce050902a9","observation_id":"a776e8f9-68c0-4624-85ac-3f8a6cc338e1","resolution":{"observed_at":"2026-07-05T11:41:03.263482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14169","last_updated":"2025-03-02T08:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T18:59:53Z","title":"Autoregressive Video Generation without Vector Quantization","version":2},"cited_work":{"arxiv_id":"2412.14169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14169","snapshot_observed_at":"2026-07-05T11:41:02.772589Z","title":"Autoregressive Video Generation without Vector Quantization","venue":"cs.CV","work_id":"11db2d86-1589-4095-8111-fa80171a943f","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2412.14169","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:e31c7b5d787c820923f25ef05804e144fdf000e43428537aca93c498ca207e0d","observation_id":"00f966d5-e693-450b-955b-7caf90ae087f","resolution":{"observed_at":"2026-07-05T11:41:02.773900Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.24717","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:02.742677Z","title":"Uniform discrete diffusion with metric path for video generation","venue":null,"work_id":"46e2b2d9-625d-40fc-9e32-3a068b28e74f","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:21311e06953122e5aaede44ee4d51dceb698bc6178000d708131b2bf5896310c","observation_id":"1f92f6cd-4fbd-4d96-a996-fcb1f73e3004","resolution":{"observed_at":"2026-07-05T11:41:02.744358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.258389Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"452b145a-e8ec-45f1-a67b-b46bc6cfefdf","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:cec7c4edb507690ef7e793f444a31ba7c91a42ea36409ff1d4e39e5d02597307","observation_id":"6856cada-94e8-476f-a217-c4ab6a4b2050","resolution":{"observed_at":"2026-07-05T11:41:03.259628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.260257Z","title":"T., Synnaeve, G., Adi, Y., and Lipman, Y","venue":null,"work_id":"7d72396b-83f2-4af5-995b-8d0d3ac082ea","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:4200fe07fcac78ae30220cce05b5fd55bc0cfc4f4512f3acff9e6d3c89145be9","observation_id":"9249372a-a7bd-43fd-92bb-d43023588d16","resolution":{"observed_at":"2026-07-05T11:41:03.261571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.264108Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment","venue":null,"work_id":"d7b935d9-5c91-49e5-a030-7125a3301afb","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:ba37d3b034b06934c970573f90ff766f09161c7b1238dad58f16f0bec52b7377","observation_id":"ed94b8f1-1c71-4248-a5c0-f7b4047cb54c","resolution":{"observed_at":"2026-07-05T11:41:03.265409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:06a8d58c05a9af463d7d217d51d3c59e32caf1c21ff3e4d5adda35d332dcef24","observation_id":"3a394d73-db75-477a-b3e2-451a84a9010c","resolution":{"observed_at":"2026-07-05T11:41:02.709455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04324","last_updated":"2025-10-15T06:35:29Z","snapshot_observed_at":"2026-07-06T22:08:40.965707Z","submitted_at":"2025-08-06T11:10:39Z","title":"TempFlow-GRPO: When Timing Matters for GRPO in Flow Models","version":4},"cited_work":{"arxiv_id":"2508.04324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.04324","snapshot_observed_at":"2026-07-09T03:05:55.312048Z","title":"TempFlow-GRPO: When Timing Matters for GRPO in Flow Models","venue":"cs.CV","work_id":"fecc731c-f8a2-4f00-ab1b-51b87a133726","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2508.04324","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:0c1547c19cafecf0e0f8d912b702c87bde388b389a39ee113dee9c6d3bab0974","observation_id":"a40fd1f7-f686-412b-8192-792a638a6738","resolution":{"observed_at":"2026-07-05T11:41:02.736138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.254146Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"2a2dff17-863e-4c53-b4e3-5e166ee52778","year":2017},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:57c80eaede97eed707698bcd5fcc91f65754fd33c61255a4684de9a1d8de11df","observation_id":"a768d9a1-0079-4627-bcc7-22f10a16f5da","resolution":{"observed_at":"2026-07-05T11:41:03.255688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.256392Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"c94773b7-02b9-41b5-8276-fe0c303de588","year":2020},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:5ccb93d0733107bf1df696aebb93360aa89ec786eaeef081d9c6861840edca7c","observation_id":"9b66c1c5-6a2a-4d4e-a7cb-0180b8814afd","resolution":{"observed_at":"2026-07-05T11:41:03.257701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":"2205.15868","doi":"10.48550/arxiv.2205.15868","metadata_source":"pith","pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","venue":"cs.CV","work_id":"2dbd6bcd-fc98-4fbf-b586-f6d94fe1abd2","year":2022},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:05c9d20a16196c912c1d66f77a519a16abc58eb9c92fad03f4501ecaa68b69ee","observation_id":"b32a3501-3f69-4e89-afdf-f150a9d66e55","resolution":{"observed_at":"2026-07-05T11:41:02.757009Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.266376Z","title":"Argmax flows and multinomial diffusion: Learning categorical distributions","venue":null,"work_id":"8c63d811-d7c9-452a-adeb-78af4acc7ae2","year":2021},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:5f0b714d0affb023e1fac1df1d20e0cd58e0d8f6823927178568b42eb68e8698","observation_id":"77e73b82-03e3-4e0f-a6db-978ac209e8ca","resolution":{"observed_at":"2026-07-05T11:41:03.267736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07730","last_updated":"2025-08-02T07:11:16Z","snapshot_observed_at":"2026-08-10T20:34:26.051486Z","submitted_at":"2025-01-13T22:37:17Z","title":"Democratizing Text-to-Image Masked Generative Models with Compact Text-Aware One-Dimensional Tokens","version":2},"cited_work":{"arxiv_id":"2501.07730","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.07730","snapshot_observed_at":"2026-07-05T11:41:02.694837Z","title":"Democra- tizing text-to-image masked generative models with com- pact text-aware one-dimensional tokens","venue":null,"work_id":"4c6ed1d1-ff49-4b68-a43c-c59931ab2c5b","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2501.07730","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:071684bc764f855d7c3c4d813f7bb3b413298f59f9f71af64ab8a5ca55f2da29","observation_id":"f0995c2f-587e-42f3-bdd3-97f8e854be63","resolution":{"observed_at":"2026-07-05T11:41:02.696875Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.251919Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"ffa1347f-c707-43d4-b138-9fd26089e96c","year":2023},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:de5428e950bc4738f954fb3686922929c26ef388b43f7c185da27d017e89548a","observation_id":"911fe3f4-1e57-49cb-9b2b-234fa6b99c77","resolution":{"observed_at":"2026-07-05T11:41:03.253269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.249725Z","title":null,"venue":null,"work_id":"fa7ab752-fc46-4787-9fee-0e8eda1d12eb","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:474a992a2bcf701d379d541ccb417189f3c854ea7fdc35c2f9e974ccdc4c835c","observation_id":"4417b52a-f941-4960-9990-e6d9ab624258","resolution":{"observed_at":"2026-07-05T11:41:03.251085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":"2302.12192","doi":"10.48550/arxiv.2302.12192","metadata_source":"pith","pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aligning Text-to-Image Models using Human Feedback","venue":"cs.LG","work_id":"39a08cdc-3986-4994-baf0-91e8ddf1b855","year":2023},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:7817547ff559f0672a645039ee5262fb07d6c57ce923380d939d52e0f95f5ee1","observation_id":"b5c8e692-e264-402f-8f0a-a85f612b7fe0","resolution":{"observed_at":"2026-07-05T11:41:02.691097Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21802","last_updated":"2026-03-20T17:20:12Z","snapshot_observed_at":"2026-08-01T16:12:11.335962Z","submitted_at":"2025-07-29T13:40:09Z","title":"MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE","version":6},"cited_work":{"arxiv_id":"2507.21802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.21802","snapshot_observed_at":"2026-07-09T03:05:55.323624Z","title":"MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE","venue":"cs.AI","work_id":"8b0ab84a-b7ea-46ea-a6ba-bf490a84d251","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2507.21802","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:91ca016abc9ca7be24c374b4c95265e5f9647f68bb38c57282f72150b7b6d484","observation_id":"b81c3fca-2bca-4437-979b-38122cd35747","resolution":{"observed_at":"2026-07-05T11:41:02.741472Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:2c7c8720e193ba208bf261e9e25e520e596fd1aed67ffc5600a46a33ab4f91ee","observation_id":"0775978b-cf29-4203-8b46-d8ef832ab3e1","resolution":{"observed_at":"2026-07-05T11:41:02.727340Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.13624","last_updated":"2023-07-27T13:13:11Z","snapshot_observed_at":"2026-08-08T15:51:26.409443Z","submitted_at":"2021-08-31T05:28:42Z","title":"Towards Out-Of-Distribution Generalization: A Survey","version":2},"cited_work":{"arxiv_id":"2108.13624","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.13624","snapshot_observed_at":"2026-07-05T11:41:02.687018Z","title":"Towards out-of-distribution generalization: A survey","venue":"cs.LG","work_id":"4fef1f90-5867-4c65-9809-7c3153413bf3","year":2021},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2108.13624","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:89cac96f0eaa16d3cbcec0b7c6457e4c1366a264ad794bdba307bf3bf7dce87c","observation_id":"96da687b-17c1-4a7e-bd1a-82ee1751759c","resolution":{"observed_at":"2026-07-05T11:41:02.688507Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.281919Z","title":"Flow-grpo: Training flow matching models via online rl","venue":null,"work_id":"c7e5bec9-47bc-4fe1-b615-7110de1b7fdc","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:4df319755b34f7c1b74d5dd72c046557b104337d4040bfaac449532fe6f7966b","observation_id":"b640459f-ed0b-4348-bb53-b8f8b7e216bf","resolution":{"observed_at":"2026-07-05T11:41:03.283195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:03:49.044969Z","title":"and Hutter, F","venue":null,"work_id":"04efe366-bf55-4b57-a1f9-29f6cd51c82a","year":2019},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:dc8bfa4d30ea7991a6d1cbad9696cf59af76fc3b61d0b40af15a26ab59741722","observation_id":"9869a29e-bc9e-4b39-8157-0264ecad0691","resolution":{"observed_at":"2026-07-05T11:41:03.281262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.13721","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:02.775249Z","title":"Next-omni: Towards any-to-any omnimodal foundation models with discrete flow matching","venue":null,"work_id":"1b671017-a960-40b7-8b57-08977021d780","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:e507c688296fc57bfc2355ada2bb0d253c06714a70986aa5515ec9eb97c4cd3e","observation_id":"b7f09390-328a-49e9-a48b-9fe86ef07b36","resolution":{"observed_at":"2026-07-05T11:41:02.776969Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.13418","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:02.748637Z","title":"Reinforcement learning meets masked generative models: Mask- grpo for text-to-image generation.arXiv preprint arXiv:2510.13418","venue":null,"work_id":"dfbf0a23-5d2f-4e88-b176-47c2d8c3f10f","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:49c5648aa5bd19044f71ab5a18ee65afce420c791f2ba30120c9b3d749e2684f","observation_id":"f15ea21e-23da-4c7a-8eb2-9fb0313dfc23","resolution":{"observed_at":"2026-07-05T11:41:02.751239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:27b242b0406cacc11e118a2e7e85f680a7f65f8ebc38062587fd189d21778694","observation_id":"05f2e48e-353b-45d8-8ebe-620ec8419267","resolution":{"observed_at":"2026-07-05T11:41:02.768393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.283872Z","title":"D., Ermon, S., and Finn, C","venue":null,"work_id":"fdbadbf3-8a37-48c9-b32d-7e68ea868ff8","year":2023},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:81201ded6629e2ce4d7e79cf28ea703a0808936960bdd458742469be3d1c1759","observation_id":"53e87148-3260-458c-8c54-baa7c96f3e4e","resolution":{"observed_at":"2026-07-05T11:41:03.285164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.277669Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"43f3d034-27a7-48de-98aa-413d0cf482bd","year":2022},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:fa0edb3794be34e9d8f0beaabab44d165d6849a9bb48a0640ab15250ed427515","observation_id":"7d731e9b-1ba6-4632-9bc2-aa257d198dd7","resolution":{"observed_at":"2026-07-05T11:41:03.279112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:a260ea91afbb98dccf458253eb13a47eb8756cbe3f7606957bad1a246dd6f45e","observation_id":"5eb561f2-ae11-49e1-9af3-8fad8d862a72","resolution":{"observed_at":"2026-07-05T11:41:02.762955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20427","last_updated":"2025-12-10T16:37:54Z","snapshot_observed_at":"2026-08-07T08:10:15.764742Z","submitted_at":"2025-09-24T17:59:04Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","version":3},"cited_work":{"arxiv_id":"2509.20427","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.20427","snapshot_observed_at":"2026-07-11T00:07:42.259448Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","venue":"cs.CV","work_id":"15c839a0-48a3-4218-82b6-cac5b7f66e13","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2509.20427","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:d0395874b3640fa4c2f4f1dfeef3b57b7504706ec0d67879e831de276b8ffd12","observation_id":"be9bdce0-d43f-4a2b-acb1-2251160bf07a","resolution":{"observed_at":"2026-07-05T11:41:02.771268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:9580e127e8ecd88101ab12a4f87437cdce16fa7fcc771399fca596fe881c272f","observation_id":"486573f1-78a0-426d-a94f-28536a499113","resolution":{"observed_at":"2026-07-05T11:41:02.747263Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03487","last_updated":"2024-12-04T17:24:35Z","snapshot_observed_at":"2026-08-03T22:07:15.352654Z","submitted_at":"2024-12-04T17:24:35Z","title":"Flow Matching with General Discrete Paths: A Kinetic-Optimal Perspective","version":1},"cited_work":{"arxiv_id":"2412.03487","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03487","snapshot_observed_at":"2026-07-05T11:41:02.752646Z","title":"Flow matching with general discrete paths: A kinetic-optimal perspective.arXiv preprint arXiv:2412.03487","venue":"cs.LG","work_id":"29011b6b-ba31-432e-9ac8-5a578589bad3","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2412.03487","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:0d20882fa2cdef7dfd42b3b4f606997aa791471c347e6e35a6cf26ee65ffabd7","observation_id":"e27124f9-ff59-4d29-892c-4b872ea89dc4","resolution":{"observed_at":"2026-07-05T11:41:02.754194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.272396Z","title":"S., Barto, A","venue":null,"work_id":"840b5e1f-d8c3-4340-a870-db9f717062fa","year":1998},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:2f7a8638d9b33e7210d06b1aab15807a6ae576885fdb8efa39259b77c6429a46","observation_id":"3abe7789-258f-47e5-9fb7-f9d6eecb4baa","resolution":{"observed_at":"2026-07-05T11:41:03.273719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.270374Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":"b6ca6606-7ae7-45b6-8c6a-79f1f8cfe23b","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:da9e8e23c718540691bd8569a24949fa21022167c0b5cfdae98fb75c68e29f26","observation_id":"529d9cef-48ba-4771-be2f-38a21d06a531","resolution":{"observed_at":"2026-07-05T11:41:03.271761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:97451477a5dc1a81a2c22776aee5163d1fdf90b41cb6ad13970e8427c28bafb7","observation_id":"782acd3b-c1c6-47c8-b995-e7a6163bd875","resolution":{"observed_at":"2026-07-05T11:41:02.706343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20147","last_updated":"2025-07-24T05:31:36Z","snapshot_observed_at":"2026-08-08T06:11:49.265407Z","submitted_at":"2025-05-26T15:46:53Z","title":"FUDOKI: Discrete Flow-based Unified Understanding and Generation via Kinetic-Optimal Velocities","version":3},"cited_work":{"arxiv_id":"2505.20147","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20147","snapshot_observed_at":"2026-07-05T11:41:02.728596Z","title":"FUDOKI: Discrete flow-based unified understanding and generation via kinetic-optimal velocities","venue":null,"work_id":"69def97c-6b34-442e-bb6f-53741695848c","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2505.20147","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:6634bf81c450a50738392519983775633fec74769d62f31941b98193b96c9ed1","observation_id":"f7f62af5-c6db-4057-85c9-ea7f551df780","resolution":{"observed_at":"2026-07-05T11:41:02.730254Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11455","last_updated":"2025-04-15T17:59:46Z","snapshot_observed_at":"2026-08-08T11:00:06.035456Z","submitted_at":"2025-04-15T17:59:46Z","title":"SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL","version":1},"cited_work":{"arxiv_id":"2504.11455","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11455","snapshot_observed_at":"2026-07-05T11:41:02.764172Z","title":"Simplear: Pushing the frontier of autoregressive visual generation through pretraining, sft, and rl","venue":"cs.CV","work_id":"facbbd34-503d-4c9a-b758-a9b88c18d9c6","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2504.11455","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:fcdfd64b563ccb7b6779fa17d207c0a60aaecf75b187088fddac11f9a731223d","observation_id":"427688d5-baaa-4134-a99d-d42f8abae46b","resolution":{"observed_at":"2026-07-05T11:41:02.765614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":"2409.18869","doi":"10.48550/arxiv.2409.18869","metadata_source":"pith","pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emu3: Next-Token Prediction is All You Need","venue":"cs.CV","work_id":"720d288e-fac0-464c-9929-19efd9a52afc","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:4d11cf3adaf5d8abe9341594f224d4bcdb0bd6ca9c4be28e430f52df0bc1083c","observation_id":"2454d854-f445-4dcb-ac5b-daba494971b3","resolution":{"observed_at":"2026-07-05T11:41:02.693604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18427","last_updated":"2025-05-17T13:26:31Z","snapshot_observed_at":"2026-08-09T23:29:58.320860Z","submitted_at":"2025-01-30T15:31:48Z","title":"SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer","version":4},"cited_work":{"arxiv_id":"2501.18427","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.18427","snapshot_observed_at":"2026-07-08T17:15:09.335782Z","title":"High- resolutionimagesynthesiswithlatentdiffusionmodels","venue":"cs.CV","work_id":"ea2bce8b-f6ab-4d7e-b28d-b16ffececa3a","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2501.18427","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:180cca7deadf4653eeef10fa6a438a09f57e1a985a1b98b9023739b65b682a07","observation_id":"53d089ec-9a4c-47b7-8f73-98b919701ef1","resolution":{"observed_at":"2026-07-05T11:41:02.724490Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":"2408.12528","doi":"10.48550/arxiv.2408.12528","metadata_source":"pith","pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","venue":"cs.CV","work_id":"1393dc24-a6b2-44e1-b5d7-7009d1fa4811","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:3223d10f9ade4cf403cd29c641137bd246d6fa7bdc33625acb17d04f5afa83d1","observation_id":"8309d9e3-b323-4341-952d-e7fba4eed161","resolution":{"observed_at":"2026-07-05T11:41:02.759648Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-08-10T06:20:33.458844Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":"2505.07818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-07-09T03:05:55.316091Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","venue":"cs.CV","work_id":"7404dd36-8f9c-478f-b089-ef9f8189c711","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:b065bc197afb66dc56e601ee0dc125c45284070bbea76e9461d35c7b8182527e","observation_id":"714ec4cd-7f0a-4bf7-8eab-9095dc0d635a","resolution":{"observed_at":"2026-07-05T11:41:02.721740Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02782","last_updated":"2025-05-02T04:42:06Z","snapshot_observed_at":"2026-08-07T16:10:49.986016Z","submitted_at":"2025-04-03T17:23:16Z","title":"GPT-ImgEval: A Comprehensive Benchmark for Diagnosing GPT4o in Image Generation","version":3},"cited_work":{"arxiv_id":"2504.02782","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.02782","snapshot_observed_at":"2026-07-05T11:41:02.715765Z","title":"Gpt-imgeval: A comprehen- sive benchmark for diagnosing gpt4o in image generation","venue":"cs.CV","work_id":"80b0a285-2676-4088-8aec-195dac7e8ceb","year":2025},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2504.02782","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:580f1890295b20c76b048d4b73679ca4e6683a04b870839f3bebd405790b4ec4","observation_id":"b3a36a80-9a83-44db-b2a4-c91951241ed6","resolution":{"observed_at":"2026-07-05T11:41:02.717476Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08265","last_updated":"2024-05-12T21:02:59Z","snapshot_observed_at":"2026-08-09T11:21:38.891668Z","submitted_at":"2024-02-13T07:37:24Z","title":"A Dense Reward View on Aligning Text-to-Image Diffusion with Preference","version":2},"cited_work":{"arxiv_id":"2402.08265","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.08265","snapshot_observed_at":"2026-07-05T11:41:02.698203Z","title":"A dense reward view on aligning text-to- image diffusion with preference","venue":"cs.CV","work_id":"6667a9e3-ca51-4761-9f50-b794d38733da","year":2024},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"cited_paper":"/paper/2402.08265","citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:1d11b441bc5372a38a1748980843a1d4878e772d4e25cb7a85a6ddcccd2d4ef9","observation_id":"8d27081b-2c26-4c0d-a0fd-c0ebea6b92b7","resolution":{"observed_at":"2026-07-05T11:41:02.699888Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:41:03.274712Z","title":"G., Yang, M.-H., Hao, Y., Essa, I., et al","venue":null,"work_id":"d4eaaabb-6a93-4b8a-a7bf-0e25d9e9a645","year":2023},"citing_paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models","version":4},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-05T11:32:38.636335Z"},"links":{"citing_paper":"/paper/2604.18518"},"observation_digest":"sha256:14c6f4a99a1e43d31bb2e251e9c5a63da75f1aead57b4551b8ff32352f3197f4","observation_id":"0c04e99a-1fe5-49d2-8239-1c83db1a03e4","resolution":{"observed_at":"2026-07-05T11:41:03.275835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.18518","last_updated":"2026-05-28T03:18:18Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T01:01:02.208278Z","submitted_at":"2026-04-20T17:16:50Z","title":"UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":2,"verified_exact":25,"verified_fuzzy":19},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 2 inbound Pith citation observations for arXiv:2604.18518."}