{"as_of":"2026-08-07T06:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2993f61be58bad63920c7f43826ccadfc5139060c2f513fcce2fbc8eccdf6cd","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:09:01.822336Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T21:47:20.112331Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:39:45.924030Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2507.21802","last_updated":"2026-03-20T17:20:12Z","snapshot_observed_at":"2026-08-01T16:12:11.335962Z","submitted_at":"2025-07-29T13:40:09Z","title":"MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE","version":6},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T13:27:50.031781Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2507.21802"},"observation_digest":"sha256:15f8b30d7dbb6214c5aa787d6c6138d6d49e8a77617c1dfb0de272aa9107fbcf","observation_id":"aa41ecd4-f187-471c-8c5d-4737894c39c5","resolution":{"observed_at":"2026-05-13T13:27:50.078729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2509.20427","last_updated":"2025-12-10T16:37:54Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T17:59:04Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T16:39:00.828442Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2509.20427"},"observation_digest":"sha256:6a8a0aeb5b2b34d5bdfee553f7ca6c5e9e44a80ff6c23850fd12b50504ea00a7","observation_id":"0f9c6109-5bb3-4599-9e82-6fd95e2f7a29","resolution":{"observed_at":"2026-05-12T16:39:00.896443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2510.16888","last_updated":"2025-11-04T13:15:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-19T15:38:06Z","title":"Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T18:01:19.748677Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2510.16888"},"observation_digest":"sha256:16b4a9a5ec9fee71b8a042cabed2151e264689cd925719a7281a49ee21c2b5ed","observation_id":"88b1eb00-efe6-485c-8474-5262e6456e6c","resolution":{"observed_at":"2026-05-21T18:01:19.893657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-08-03T21:47:20.112331Z","title":"Rewarddance: Reward scaling in visual generation.arXiv preprint arXiv:2509.08826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.13649","last_updated":"2026-07-03T19:09:38Z","snapshot_observed_at":"2026-08-06T17:42:18.711494Z","submitted_at":"2025-11-17T17:59:54Z","title":"Distribution Matching Distillation Meets Reinforcement Learning","version":5},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T21:47:20.112331Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2511.13649"},"observation_digest":"sha256:65315072914277c6915417c51adfda7ad83ff125f66eca213c774987f42f5671","observation_id":"5bc90bef-5c59-4c41-accd-9ced908fd7a5","resolution":{"observed_at":"2026-08-03T21:47:20.112331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2512.04678","last_updated":"2025-12-28T11:15:39Z","snapshot_observed_at":"2026-08-04T14:52:25.854038Z","submitted_at":"2025-12-04T11:12:13Z","title":"Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-16T18:17:54.943863Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2512.04678"},"observation_digest":"sha256:30f0529348f2f5eb0ed7dc7c09920573f259e2e6d578cecc2697e8ec954afac3","observation_id":"53be49cc-2695-4ae0-a27a-2e225b9edff9","resolution":{"observed_at":"2026-05-16T18:17:55.054498Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2512.13507","last_updated":"2025-12-23T17:38:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-15T16:36:52Z","title":"Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T01:35:37.817082Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2512.13507"},"observation_digest":"sha256:39aaef625da6affe31a56d60841ae09a0e277ef703d5f3f7d428aef74d09f91c","observation_id":"8e67035b-89db-48f8-9eda-19f252874dad","resolution":{"observed_at":"2026-05-16T01:35:37.891530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2602.11146","last_updated":"2026-05-22T14:43:10Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T18:57:29Z","title":"Beyond VLM-Based Rewards: Diffusion-Native Latent Reward Modeling","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-25T06:41:33.493927Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2602.11146"},"observation_digest":"sha256:80a5234bd7d62de2a99e6eefb179b03c5eb50b05c4f26816c737007900c36c89","observation_id":"38ee40f4-d9f5-422d-b436-c1dd5598246c","resolution":{"observed_at":"2026-05-25T06:45:26.073726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-07-06T23:02:00.082783Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T13:34:36.248186Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2604.14148"},"observation_digest":"sha256:48c9e50a90cc49dd125ce396070d0922279bcdc1f152e426f6bd7a15b9d2b0b3","observation_id":"ee3ef21c-0e70-4519-894f-780fdc8f522d","resolution":{"observed_at":"2026-05-10T13:35:26.276205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2604.25427","last_updated":"2026-04-28T09:34:51Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T09:34:51Z","title":"A Systematic Post-Train Framework for Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-07T16:58:33.014401Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2604.25427"},"observation_digest":"sha256:22102f7621f6068e0578351666e1b4fb3ee72bbba77945ba65dc1d6db788cae0","observation_id":"e7328192-0136-46d3-8da4-955bba962ac0","resolution":{"observed_at":"2026-05-11T23:26:20.184788Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2604.27505","last_updated":"2026-05-20T07:08:10Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:54:39Z","title":"Leveraging Verifier-Based Reinforcement Learning in Image Editing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-07T08:00:33.307429Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2604.27505"},"observation_digest":"sha256:2f16cfff46890edceb50ac0da170b9e4c5c0f20760903db448251f2f5245a400","observation_id":"055871ed-053e-4653-a29e-8ef0bf1af01f","resolution":{"observed_at":"2026-05-12T10:06:27.520658Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2604.27505","last_updated":"2026-05-20T07:08:10Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:54:39Z","title":"Leveraging Verifier-Based Reinforcement Learning in Image Editing","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-21T09:11:02.183133Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2604.27505"},"observation_digest":"sha256:d45cb59ecb6e50d5f9bd5529ea13db2451a6476956023365407b73f2063302a5","observation_id":"5eaba5f4-7dea-4564-b3bc-8bb8268a148c","resolution":{"observed_at":"2026-05-21T09:14:05.973733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.05922","last_updated":"2026-05-12T06:25:12Z","snapshot_observed_at":"2026-07-06T23:18:26.864785Z","submitted_at":"2026-05-07T09:30:58Z","title":"Think, then Score: Decoupled Reasoning and Scoring for Video Reward Modeling","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T07:37:52.346280Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.05922"},"observation_digest":"sha256:0186415ee577c430390448da5f11bc4f20007de06f366697a6056fb8d995f618","observation_id":"b1b1e6f1-ac7f-48aa-bf61-77fe883a442c","resolution":{"observed_at":"2026-05-13T07:42:30.786573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.10983","last_updated":"2026-05-13T08:00:49Z","snapshot_observed_at":"2026-07-06T23:22:52.369277Z","submitted_at":"2026-05-09T04:41:02Z","title":"TMPO: Trajectory Matching Policy Optimization for Diverse and Efficient Diffusion Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T07:36:16.811765Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.10983"},"observation_digest":"sha256:c377d4b4aa811506d6160cda2a0691a985265ae96884691262b82231bcfa9b2f","observation_id":"18e9cbc2-15da-49eb-b302-ae263df069f0","resolution":{"observed_at":"2026-05-13T07:37:29.181018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.10983","last_updated":"2026-05-13T08:00:49Z","snapshot_observed_at":"2026-07-06T23:22:52.369277Z","submitted_at":"2026-05-09T04:41:02Z","title":"TMPO: Trajectory Matching Policy Optimization for Diverse and Efficient Diffusion Alignment","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T22:01:21.695270Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.10983"},"observation_digest":"sha256:7342eb129f89f1d9e0fa775fcb8b80af0e8310cdcff84e7f9f6a9d625add04f9","observation_id":"89a90e18-c6af-43be-ab91-cb40c0d2ff94","resolution":{"observed_at":"2026-05-14T22:03:02.863836Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.11723","last_updated":"2026-05-28T12:50:43Z","snapshot_observed_at":"2026-08-01T23:43:09.636688Z","submitted_at":"2026-05-12T08:08:33Z","title":"CaC: Advancing Video Reward Models via Hierarchical Spatiotemporal Concentrating","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T06:00:31.582714Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.11723"},"observation_digest":"sha256:4fdaf2ca5035fc11d7caf3832a64a9003ab6464920cd136b4fa836953b9c3ee1","observation_id":"a3dbd52d-cab0-45e8-b875-8a9872158d8c","resolution":{"observed_at":"2026-05-13T06:02:22.029828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.11723","last_updated":"2026-05-28T12:50:43Z","snapshot_observed_at":"2026-08-01T23:43:09.636688Z","submitted_at":"2026-05-12T08:08:33Z","title":"CaC: Advancing Video Reward Models via Hierarchical Spatiotemporal Concentrating","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-30T22:38:43.102769Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.11723"},"observation_digest":"sha256:76da04cfb1af64cf52f9ebcfd3eda9fe491688872b82c59c7ece8bc15354376f","observation_id":"68a52997-103e-422e-81c8-d98091d48fc1","resolution":{"observed_at":"2026-07-01T13:55:45.300168Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.15055","last_updated":"2026-05-14T16:49:09Z","snapshot_observed_at":"2026-08-01T03:43:04.469611Z","submitted_at":"2026-05-14T16:49:09Z","title":"DiffusionOPD: A Unified Perspective of On-Policy Distillation in Diffusion Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T21:20:23.420424Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.15055"},"observation_digest":"sha256:2051ca5dafa5228b6e9f58ad6e738ee9dce77a626227de882782b5a8ac32e583","observation_id":"dadec1d0-7167-44be-bfb7-631db441c849","resolution":{"observed_at":"2026-07-01T14:25:46.853546Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.16951","last_updated":"2026-05-16T12:05:39Z","snapshot_observed_at":"2026-08-02T16:28:04.937142Z","submitted_at":"2026-05-16T12:05:39Z","title":"Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T20:44:54.356658Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.16951"},"observation_digest":"sha256:652c891f46f3938bd3bc6f8d74784f6addd6cf250d3869d9bc01a65bc9353a13","observation_id":"cfaf8c48-414d-495c-b4fb-a7cb715e6ad4","resolution":{"observed_at":"2026-05-19T20:47:45.836625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.00267","last_updated":"2026-05-29T18:57:57Z","snapshot_observed_at":"2026-07-06T23:41:01.066075Z","submitted_at":"2026-05-29T18:57:57Z","title":"StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-06-28T22:45:58.629263Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.00267"},"observation_digest":"sha256:27b692d51ca8df63fb47c8caff8cb6dc5879f3248246e413628adc671b581c1c","observation_id":"bc19bdb5-f87f-4e3f-8b2b-b1779a76eed8","resolution":{"observed_at":"2026-07-01T19:25:59.831028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.00583","last_updated":"2026-05-30T07:21:40Z","snapshot_observed_at":"2026-08-06T21:04:24.758200Z","submitted_at":"2026-05-30T07:21:40Z","title":"Improving Visual Representation Alignment Generation with GRPO","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T19:24:09.597127Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.00583"},"observation_digest":"sha256:dcce2e14fbe3f6298c932d2765660d1301e3e50c993916e532b495d0904f270a","observation_id":"485db53f-e8ef-480a-bb21-91d596b0bdc5","resolution":{"observed_at":"2026-06-28T19:32:35.129428Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.02884","last_updated":"2026-06-01T20:56:24Z","snapshot_observed_at":"2026-08-06T19:01:40.676359Z","submitted_at":"2026-06-01T20:56:24Z","title":"Are we really tilting? The mechanics of reward guidance in flow and diffusion models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T15:20:52.980868Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.02884"},"observation_digest":"sha256:31a9e847f9518be7e44e3b875788f24f549be46ec6220c705bb8c4a7ba59c6fb","observation_id":"876aee65-1061-4fbc-b3d5-b22c4f1ad8aa","resolution":{"observed_at":"2026-07-01T22:26:18.153780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.09076","last_updated":"2026-07-14T12:46:55Z","snapshot_observed_at":"2026-07-17T23:19:03.633221Z","submitted_at":"2026-06-08T06:20:12Z","title":"Z-Reward: Beyond Scalar Rewards by Internalizing Reasoning into Score Distributions","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-27T17:30:57.001021Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.09076"},"observation_digest":"sha256:9e7feca0b03b8dfc6b153882051602dc7985ec201cf95eabd704b6a08855b110","observation_id":"1c45d939-a4dd-476c-9e57-1990a9cbc875","resolution":{"observed_at":"2026-07-03T00:07:27.944548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-15T10:53:37.186361Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09076","last_updated":"2026-07-14T12:46:55Z","snapshot_observed_at":"2026-07-17T23:19:03.633221Z","submitted_at":"2026-06-08T06:20:12Z","title":"Z-Reward: Beyond Scalar Rewards by Internalizing Reasoning into Score Distributions","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-15T10:53:37.186361Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.09076"},"observation_digest":"sha256:4b787135f676cf7f9f51f995d9f08991fed6c2499f2bd3f6955401b64d7c1c10","observation_id":"6e797adc-88a9-454b-89af-7a97da480d64","resolution":{"observed_at":"2026-07-15T10:53:37.186361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:20b03ca802cd09230846a3c3899efe01cf71f5eec2b6105ccbf2bfb9384b5ff6","observation_id":"494cc52e-0a45-4538-8d3d-0487d70aa0d5","resolution":{"observed_at":"2026-07-04T10:09:45.413050Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.23626","last_updated":"2026-06-22T17:19:58Z","snapshot_observed_at":"2026-08-02T21:31:41.183160Z","submitted_at":"2026-06-22T17:19:58Z","title":"DiT-Reward: Generative Representations for Text-to-Image Reward Modeling","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-06-26T08:35:04.038960Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.23626"},"observation_digest":"sha256:bbfb38a73b0256d6bff34be2a7fe4870f03938a0e43b81a85790ff76a9ad4995","observation_id":"0b5713ab-4f56-45d7-9d42-b547b47d54e2","resolution":{"observed_at":"2026-07-04T10:39:45.925822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.27771","last_updated":"2026-08-06T03:19:05Z","snapshot_observed_at":"2026-08-07T06:34:59.122896Z","submitted_at":"2026-06-26T06:56:54Z","title":"NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T05:00:04.037802Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.27771"},"observation_digest":"sha256:d1e3d508e843a769daffad863e027ed39930711ce2cd191a22f72fcdd074839c","observation_id":"47831f1c-db81-48f8-b061-18d80119d225","resolution":{"observed_at":"2026-06-29T19:03:51.757351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-12T11:38:13.566600Z","title":"Rewarddance: Reward scaling in visual generation.arXivpreprint arXiv:2509.08826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27771","last_updated":"2026-08-06T03:19:05Z","snapshot_observed_at":"2026-08-07T06:34:59.122896Z","submitted_at":"2026-06-26T06:56:54Z","title":"NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T11:38:13.566600Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.27771"},"observation_digest":"sha256:71a2d1befead2c79445d7c595c182bb780ead5406849ee11b2100cc63f572b94","observation_id":"a16b5dda-0a53-42b1-9613-000a8c0c17a9","resolution":{"observed_at":"2026-07-12T11:38:13.566600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-08-02T09:56:25.929049Z","title":"Rewarddance: Reward scaling in visual generation.arXivpreprint arXiv:2509.08826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27771","last_updated":"2026-08-06T03:19:05Z","snapshot_observed_at":"2026-08-07T06:34:59.122896Z","submitted_at":"2026-06-26T06:56:54Z","title":"NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T09:56:25.929049Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.27771"},"observation_digest":"sha256:03217778cd57d6626a849620824017b4c4285f5978eb1b6adf3e4a33ef5152dd","observation_id":"c62e0581-9e0c-43ee-b72f-9b3456248803","resolution":{"observed_at":"2026-08-02T09:56:25.929049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-08-02T00:41:12.594851Z","title":"RewardDance: Reward scaling in visual generation.arXiv preprint arXiv:2509.08826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-07T05:59:38.444442Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.594851Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:704bd9da192fdfa6c6fccc959bcc893223f4e15de3d100c7ea31ccdd812bbc22","observation_id":"99a15030-df7d-4c09-b32d-139e4a24111f","resolution":{"observed_at":"2026-08-02T00:41:12.594851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-08-01T16:12:23.899000Z","title":"2509.08826 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18091","last_updated":"2026-07-20T15:55:33Z","snapshot_observed_at":"2026-08-05T15:24:58.642792Z","submitted_at":"2026-07-20T15:55:33Z","title":"SciForma: Structure-Faithful Generation of Scientific Diagrams","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-01T16:12:23.899000Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2607.18091"},"observation_digest":"sha256:1c8f6db2488fcd8f301fe0769310bfface2995437ac1a3eea55797f446a5fca8","observation_id":"25d55f6b-63ee-43f3-b764-9312d1880f41","resolution":{"observed_at":"2026-08-01T16:12:23.899000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.08826/citation-record","integrity":"/paper/2509.08826/integrity","json":"/paper/2509.08826/citation-record.json","paper":"/paper/2509.08826"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.04233","last_updated":"2024-05-07T11:52:49Z","snapshot_observed_at":"2026-07-06T18:10:57.647004Z","submitted_at":"2024-05-07T11:52:49Z","title":"Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04233","snapshot_observed_at":"2026-08-04T20:08:55.396895Z","title":"Vidu: a highly consistent, dynamic and skilled text-to-video generator with diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.396895Z"},"links":{"cited_paper":"/paper/2405.04233","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:7a81bdc193b51623ecbf10a2713129da681017b8ca4de07417d4cd321693af4d","observation_id":"86905ea5-c022-43bb-8b50-c37819f87f6f","resolution":{"observed_at":"2026-08-04T20:08:55.396895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:55.529478Z","title":"Improving image generation with better captions.Computer Science","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.529478Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:7a4f806948e2a29dd926f4a0acb77179b6007ff07554bb753a5ee2f0bd5971f3","observation_id":"ea855739-cf41-40b2-aa1e-1d10a6592d1f","resolution":{"observed_at":"2026-08-04T20:08:55.529478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-01T15:43:51.739518Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-04T20:08:55.650307Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.650307Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:5fb44c1aef617dcb69401fbea954f5d42bbe5766110124852ff96296dd587faa","observation_id":"132c6830-d12c-43f7-9156-dddaf4ed4d40","resolution":{"observed_at":"2026-08-04T20:08:55.650307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-04T20:08:55.746553Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.746553Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:90cfc7c120beced077a2a085fc3f6d5bc9b7cb10e7e2184e93909a457fa882d9","observation_id":"7efa567e-ef00-4989-a064-45e848d36bbf","resolution":{"observed_at":"2026-08-04T20:08:55.746553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:55.865292Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.865292Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:a0acd8069263fd892b0732331b03c7ad64d544d0223253dcd20310727605942d","observation_id":"3abdd8b0-0899-4016-a961-6a5bcadc57df","resolution":{"observed_at":"2026-08-04T20:08:55.865292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:55.944987Z","title":"Video generation models as world simulators.OpenAI Blog, 1(8):1, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.944987Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:3d47e85dd01116689db4501748708f675406b280091faf05495f0c157fea1dfd","observation_id":"c3a37bb2-8a9b-4395-8d20-11ff4747b2f4","resolution":{"observed_at":"2026-08-04T20:08:55.944987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-04T20:08:56.030031Z","title":"Pixart-α: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.030031Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:c2990a77e407d50a92f3eb78efb96aca03e24dd3cf09086177f4f92c520f7f42","observation_id":"0f4bcd2d-bb19-4f13-b4b8-18379f110cfc","resolution":{"observed_at":"2026-08-04T20:08:56.030031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:56.108706Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models.CoRR, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.108706Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:2907e82a3362ab85d176b20c3e60366995777acb923bfb602ff64c9337faa52a","observation_id":"e91579b9-d6e5-4c0c-9e9d-818bfe04fc4c","resolution":{"observed_at":"2026-08-04T20:08:56.108706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06554","last_updated":"2024-10-16T04:48:08Z","snapshot_observed_at":"2026-08-05T02:22:02.033882Z","submitted_at":"2024-10-09T05:17:08Z","title":"The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06554","snapshot_observed_at":"2026-08-04T20:08:56.202728Z","title":"The accuracy paradox in rlhf: When better reward models don’t yield better language models.arXiv preprint arXiv:2410.06554, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.202728Z"},"links":{"cited_paper":"/paper/2410.06554","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:90b08ab65bf96c6bbf498440013073f42594640f7b4e5bf169ba7063d73f2f3d","observation_id":"b272c883-8db7-4937-86eb-367ad3b86f30","resolution":{"observed_at":"2026-08-04T20:08:56.202728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-04T20:08:56.309210Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling.arXiv preprint arXiv:2412.05271, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.309210Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:f28d0960aef230a116ff60531976789693f7ca44cc1af7ec3a1671bd1830e517","observation_id":"486d1163-e00a-4ea2-9d8a-5cf8cd809e93","resolution":{"observed_at":"2026-08-04T20:08:56.309210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-04T20:08:56.415726Z","title":"Raft: Reward ranked finetuning for generative foundation model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.415726Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:894fad93b24c8eba03e5d795fd6444696246d4ffd0669c20c842f3d2f07d98b0","observation_id":"e2b42bf0-44f1-4691-ad5a-fc91b0429d1a","resolution":{"observed_at":"2026-08-04T20:08:56.415726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:56.497198Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.497198Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:4745a98fb448771710c1ab932c33cf1ead77b17dccb03415f106abec41c0ffd8","observation_id":"e8c40eb9-35e7-4a24-aa42-90d44b3ff2ab","resolution":{"observed_at":"2026-08-04T20:08:56.497198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:56.572535Z","title":"Reinforcement learning for fine-tuning text-to-image diffusion mod- els","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.572535Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:40ad1ba6233c50ae23935131528484efe0f4b8de24f34ab993070e1656ff94b7","observation_id":"1382ada2-b0c5-4221-8d9c-7225d5b6876a","resolution":{"observed_at":"2026-08-04T20:08:56.572535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11346","last_updated":"2025-06-28T11:46:35Z","snapshot_observed_at":"2026-07-06T21:09:50.780345Z","submitted_at":"2025-04-15T16:19:07Z","title":"Seedream 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11346","snapshot_observed_at":"2026-08-04T20:08:56.678650Z","title":"Seedream 3.0 technical report.arXiv preprint arXiv:2504.11346, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.678650Z"},"links":{"cited_paper":"/paper/2504.11346","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:ce0be35510d129ba3f5e4a4f266b8172b2235b57419cfd22798253117ebdbe13","observation_id":"c4bbc6c6-5620-430b-94b2-27eedc40a862","resolution":{"observed_at":"2026-08-04T20:08:56.678650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09113","last_updated":"2025-06-28T11:58:23Z","snapshot_observed_at":"2026-08-01T16:09:18.068564Z","submitted_at":"2025-06-10T17:56:11Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09113","snapshot_observed_at":"2026-08-04T20:08:56.802057Z","title":"Seedance 1.0: Exploring the boundaries of video generation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.802057Z"},"links":{"cited_paper":"/paper/2506.09113","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:7547f39e401c6b5491daceeb3daac52990fc69d8b39dbb05994a4abf4832e213","observation_id":"e1ed9b66-e8ca-4b34-9f27-5433927eb701","resolution":{"observed_at":"2026-08-04T20:08:56.802057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07703","last_updated":"2025-03-10T17:58:33Z","snapshot_observed_at":"2026-07-06T20:50:09.622181Z","submitted_at":"2025-03-10T17:58:33Z","title":"Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07703","snapshot_observed_at":"2026-08-04T20:08:56.884737Z","title":"Seedream 2.0: A native chinese-english bilingual image generation foundation model.arXiv preprint arXiv:2503.07703, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.884737Z"},"links":{"cited_paper":"/paper/2503.07703","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:dd1091497f225998e49d385bb9bb668fc9cc71a19a485217940da2e1aab8e2d5","observation_id":"da4d94ab-2adb-47a2-8c1f-a6dcf2fc3c85","resolution":{"observed_at":"2026-08-04T20:08:56.884737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:56.953258Z","title":"Veo.https://deepmind.google/models/veo/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.953258Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:e892c2cfc5c6b534b2693158edbd91dcd3f403cf70f7f69dd6d77c2db9cd3777","observation_id":"d6e63974-c7c7-459b-a90b-de923f36774b","resolution":{"observed_at":"2026-08-04T20:08:56.953258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04713","last_updated":"2025-03-20T00:04:47Z","snapshot_observed_at":"2026-07-06T19:46:41.798193Z","submitted_at":"2024-11-06T05:02:29Z","title":"Multi-Reward as Condition for Instruction-based Image Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04713","snapshot_observed_at":"2026-08-04T20:08:57.041134Z","title":"Multi-reward as condition for instruction-based image editing.arXiv preprint arXiv:2411.04713, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.041134Z"},"links":{"cited_paper":"/paper/2411.04713","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:62a30b9c9d23a53c8b42da8811dcedfc892117e587db569947e040601110c9bf","observation_id":"301b6b30-f1d6-4a81-8021-787bedd2734f","resolution":{"observed_at":"2026-08-04T20:08:57.041134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-04T20:08:57.137515Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.137515Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:539e9ee5b2790dfeb588949843625c75336f40d520f0f82e716f9376731e0a43","observation_id":"9093d8ed-5bfb-4fb1-b9d5-4663fcf14436","resolution":{"observed_at":"2026-08-04T20:08:57.137515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.228352Z","title":"A simple and effective reinforcement learning method for text-to-image diffusion fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.228352Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:bbb4523be077efb5ed23a0ace4c5f6c871cbcc348f23e6987f2ce6a6fe500735","observation_id":"32d7c0f9-754f-47c4-b243-f3d6527613a3","resolution":{"observed_at":"2026-08-04T20:08:57.228352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.297593Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.297593Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:9b40bdd9a9834edb4589db64063e20ee993c04bc495f9729d1b71de8ced6fa48","observation_id":"31caed26-a32f-4c1d-a531-0594ffda0736","resolution":{"observed_at":"2026-08-04T20:08:57.297593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.397897Z","title":"Ideogram.https://about.ideogram.ai/1.0., 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.397897Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:6f2bfec9a5c3aee878bb0df094d7305e5d3433cc30f4927dcf4b0053dd9d8410","observation_id":"79c2c946-32a1-47a5-a3c1-8ee6c77af671","resolution":{"observed_at":"2026-08-04T20:08:57.397897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.483267Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation.Advancesin neural information processing systems, 36:36652–36663, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.483267Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:af7d09652fa4e7022dda56dc50f27b3e67650ddc288efd20134492db0513fc37","observation_id":"b88cd1fa-c9b6-41d9-aa71-bf3d89cbaa92","resolution":{"observed_at":"2026-08-04T20:08:57.483267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.585056Z","title":"klingai.https://app.klingai.com/cn/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.585056Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:0d0b660cc1f636f05786d78515711b8bbda50b00f015b425c011154a5f3d0c73","observation_id":"200e654a-6de4-4478-86be-48c758073b93","resolution":{"observed_at":"2026-08-04T20:08:57.585056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-04T20:08:57.666163Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.666163Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:5d1513ca27ae19c2a71bdcf2cf61dac7a9f1ae5a8820b80eb0966ba1e7d7e405","observation_id":"836d2260-1b27-41f8-82c9-82b7380589d3","resolution":{"observed_at":"2026-08-04T20:08:57.666163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.744104Z","title":"Flux: Official inference repository for flux.1 models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.744104Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:d23c0d94d09c912b853ec758bbea5b9e45c4881b2d8313df38ce24d9f5334ce8","observation_id":"af1ebe2a-2734-4c43-a81c-231af56b104d","resolution":{"observed_at":"2026-08-04T20:08:57.744104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.838549Z","title":"Flux.https://github.com/black-forest-labs/flux, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.838549Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:ca8a54ebe106d3280285582b968dc3e03f9e9c6c8382ea6a3d64e3e932809d9d","observation_id":"94a153bb-e4c9-46f1-bbac-6a8c7f108c32","resolution":{"observed_at":"2026-08-04T20:08:57.838549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.926797Z","title":"Controlnet++: Improving conditional controls with efficient consistency feedback: Project page: liming-ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.926797Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:ddf85cd68c36544a0ff5e0807dff75b34658fa563301b5d6461e04db93c61d50","observation_id":"8e4c83b1-f2ed-44cd-91a9-df9a6b582506","resolution":{"observed_at":"2026-08-04T20:08:57.926797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02370","last_updated":"2025-05-05T05:19:40Z","snapshot_observed_at":"2026-07-06T21:18:55.327700Z","submitted_at":"2025-05-05T05:19:40Z","title":"SuperEdit: Rectifying and Facilitating Supervision for Instruction-Based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02370","snapshot_observed_at":"2026-08-04T20:08:58.003125Z","title":"Superedit: Rectifying and facilitating supervision for instruction-based image editing.arXiv preprint arXiv:2505.02370, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.003125Z"},"links":{"cited_paper":"/paper/2505.02370","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:446357ab4b07b53313cc4b188cb1c0b8e2b61d410d36fb339d214bf0d76a6bb7","observation_id":"fba2b18b-871c-4917-8670-bbc8e802f8ee","resolution":{"observed_at":"2026-08-04T20:08:58.003125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05195","last_updated":"2025-07-21T21:23:51Z","snapshot_observed_at":"2026-07-06T19:47:07.442952Z","submitted_at":"2024-11-07T21:39:51Z","title":"Exploring How Generative MLLMs Perceive More Than CLIP with the Same Vision Encoder","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05195","snapshot_observed_at":"2026-08-04T20:08:58.110097Z","title":"Exploring how generative mllms perceive more than clip with the same vision encoder.arXiv preprint arXiv:2411.05195, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.110097Z"},"links":{"cited_paper":"/paper/2411.05195","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:816c97ae856faf59a515cf857e412b1d0df413e6e394ec8e650096a5238ca1de","observation_id":"980525a9-64b4-4034-bc9c-1b258ed6ce7a","resolution":{"observed_at":"2026-08-04T20:08:58.110097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:58.185503Z","title":"An inverse scaling law for clip training.Advancesin Neural Information Processing Systems, 36:49068–49087, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.185503Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:98916df846a17afbe08fe71e0eb579d90c0833d8fe26b308ff736f0d7c0c6b06","observation_id":"40a2ebf7-fa29-4820-92fe-524f2545a508","resolution":{"observed_at":"2026-08-04T20:08:58.185503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05472","last_updated":"2025-05-11T18:47:18Z","snapshot_observed_at":"2026-08-04T22:02:38.792513Z","submitted_at":"2025-05-08T17:58:57Z","title":"Mogao: An Omni Foundation Model for Interleaved Multi-Modal Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05472","snapshot_observed_at":"2026-08-04T20:08:58.270191Z","title":"Mogao: An omni foundation model for interleaved multi-modal generation.arXiv preprint arXiv:2505.05472, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.270191Z"},"links":{"cited_paper":"/paper/2505.05472","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:72af559e74c31f30a1f137d4de13a6125fed45932437417669193b7485897e06","observation_id":"9e56985d-a38c-4a4a-bc8a-387d8247ca8e","resolution":{"observed_at":"2026-08-04T20:08:58.270191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-04T20:08:58.373978Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.373978Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:fae031d5f8d5f6893a5ed3d98e14476002f665c42d896c083f591a47e962842c","observation_id":"dbb474ed-47dd-4165-879f-85a61565a7b8","resolution":{"observed_at":"2026-08-04T20:08:58.373978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-06T11:11:00.378627Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-08-04T20:08:58.469893Z","title":"Flow-grpo: Training flow matching models via online rl.arXiv preprint arXiv:2505.05470, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.469893Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:7540fc73c3ab20ee9f5e855520ad568ee6104621dd1fea6c15ecd12487a5cedb","observation_id":"8fa26720-2d27-44f9-ab9f-4fc28f386f7a","resolution":{"observed_at":"2026-08-04T20:08:58.469893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13918","last_updated":"2025-10-27T08:22:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-23T18:55:41Z","title":"Improving Video Generation with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13918","snapshot_observed_at":"2026-08-04T20:08:58.572097Z","title":"Improving video generation with human feedback.arXiv preprint arXiv:2501.13918, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.572097Z"},"links":{"cited_paper":"/paper/2501.13918","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:bb1d483c764ec7488520f2c4ae0c39da8f3b8432919ead5061bff851e32adf24","observation_id":"dcf4dd50-8905-4504-afa9-b61b94c65d46","resolution":{"observed_at":"2026-08-04T20:08:58.572097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:58.678868Z","title":"Inference-time scaling for generalist reward modeling.arXiv preprint arXiv:2504.02495, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.678868Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:0eb1872db8adf7cd4e98e7020492cb46e170de41aa749fb2244e1b9fe041bf1e","observation_id":"b90777e3-0f54-4c9f-b360-3e758cd57151","resolution":{"observed_at":"2026-08-04T20:08:58.678868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:58.744034Z","title":"lumalabs.https://lumalabs.ai/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.744034Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:b40c3841b37ee952dd1b566ed3c746d1a6ac6a6324af38d343e7ed9376f4e345","observation_id":"d26e027a-12f0-4535-b7df-455007611c6f","resolution":{"observed_at":"2026-08-04T20:08:58.744034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-08-04T20:08:58.832391Z","title":"Step-video-t2v technical report: The practice, challenges, and future of video foundation model.arXiv preprint arXiv:2502.10248, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.832391Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:a7ebaad714443b3f1f668266b91ec2a0614928ece96ab104374753c43ae72e45","observation_id":"e5445f7e-d9e2-48ea-89bf-662cbd1b64c2","resolution":{"observed_at":"2026-08-04T20:08:58.832391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-07-06T20:22:04.328179Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09732","snapshot_observed_at":"2026-08-04T20:08:58.890930Z","title":"Inference-time scaling for diffusion models beyond scaling denoising steps","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.890930Z"},"links":{"cited_paper":"/paper/2501.09732","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:6c65039856c3f9fb1c2080e3b9f8d899e2a57a6f3ca6c5286fd812aaa3f3a56c","observation_id":"873f0fa2-ce1c-463e-81ea-5695252c4ed2","resolution":{"observed_at":"2026-08-04T20:08:58.890930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03789","last_updated":"2025-08-22T08:53:37Z","snapshot_observed_at":"2026-08-06T04:22:44.373906Z","submitted_at":"2025-08-05T17:17:13Z","title":"HPSv3: Towards Wide-Spectrum Human Preference Score","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03789","snapshot_observed_at":"2026-08-04T20:08:58.995776Z","title":"Hpsv3: Towards wide-spectrum human preference score","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.995776Z"},"links":{"cited_paper":"/paper/2508.03789","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:4750b9c70d25e938e0559fa05cb363f8846b16b56124226d4a479f18c8cc4868","observation_id":"3930fdb3-dd8b-4d9a-abf8-1030b39d043a","resolution":{"observed_at":"2026-08-04T20:08:58.995776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.094853Z","title":"midjourney.https://www.midjourney.com/home, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.094853Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:965b58380994d93b193df8071c79eea33a8982e9e1ddcc5b928da1b17d759b6b","observation_id":"69192038-94c5-445a-bf15-8916ef183f2f","resolution":{"observed_at":"2026-08-04T20:08:59.094853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.185710Z","title":"Inference-time text-to-video alignment with diffusion latent beam search.arXiv preprint arXiv:2501.19252, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.185710Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:fafab5246c4613890e9a0c448f6868f9888d103e44f022d1b02ead86386f4a80","observation_id":"d0664f12-d885-48ec-a8de-318928b50deb","resolution":{"observed_at":"2026-08-04T20:08:59.185710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.294363Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.294363Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:201a50a47c2f6283b503bad0f23242127787376111ad543f9390ac44f5e9120b","observation_id":"668c5b5a-e40c-4444-9aaf-14c4c7247767","resolution":{"observed_at":"2026-08-04T20:08:59.294363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-04T20:08:59.377336Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.377336Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:f8784be833eebdedaaf8b0b448ac9ca2f35eea722ada4afc7df845bfe868b6ed","observation_id":"866901a6-8d1e-4f11-9f59-ecec90bfcced","resolution":{"observed_at":"2026-08-04T20:08:59.377336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-04T20:08:59.470265Z","title":"Hierarchical text-conditional image generation with clip latents.arXiv preprint arXiv:2204.06125, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.470265Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:9a395bd413d4a53cce6627f592c17f0c290d4017d5298cc5207d3360e4635970","observation_id":"977bd8af-fed2-4656-ba94-2b087858437a","resolution":{"observed_at":"2026-08-04T20:08:59.470265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.549832Z","title":"What makes a reward model a good teacher? an optimization perspective.arXiv preprint arXiv:2503.15477, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.549832Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:0414fff6c0db4c8b4d1167084125bf6e741ce79efe18a4f11ae08649b2294e47","observation_id":"efc721e4-fdb0-4f99-a5ea-fab919a1130e","resolution":{"observed_at":"2026-08-04T20:08:59.549832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.607627Z","title":"recraft.https://www.recraft.ai/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.607627Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:3728511e29ad025472f31b6707e3453c9935db7d3d4b1d9c55109ac4ff78d191","observation_id":"e3b317e8-9a99-42d8-87b3-6274f9ad808e","resolution":{"observed_at":"2026-08-04T20:08:59.607627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.703606Z","title":"Byteedit: Boost, comply and accelerate generative image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.703606Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:157503f111b4a18bbd568479022e339466b437af4611f7f8a8da778cb6ae267d","observation_id":"81fb23ff-d3e2-4f00-99b9-c2f63a0f3a80","resolution":{"observed_at":"2026-08-04T20:08:59.703606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.800075Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.800075Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:4df4cdfc9d583ba2a47080bed452dfb0de94d123820316720349219faa657c86","observation_id":"5da2af02-3f3f-409f-baf2-707e228638a6","resolution":{"observed_at":"2026-08-04T20:08:59.800075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.895610Z","title":"Runway.https://runwayml.com/research/introducing-runway-gen-4, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.895610Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:72462a903d79a3a8db1e1362b49c80e1dfc4ba5f0c6ae2dfad3228f0f2271f9f","observation_id":"f14a6ad6-6c8e-4c6e-bb67-41c035ef8863","resolution":{"observed_at":"2026-08-04T20:08:59.895610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08685","last_updated":"2025-05-05T03:31:30Z","snapshot_observed_at":"2026-07-06T21:08:01.403325Z","submitted_at":"2025-04-11T16:46:20Z","title":"Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08685","snapshot_observed_at":"2026-08-04T20:08:59.968870Z","title":"Seaweed-7b: Cost-effective training of video generation foundation model.arXiv preprint arXiv:2504.08685, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.968870Z"},"links":{"cited_paper":"/paper/2504.08685","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:d9f2275429da01cdb3c3dbae6639b1f0d19e16f63c65976be47bdd950287a4b2","observation_id":"064fc98f-5828-48a3-ba5a-292bb297fa5d","resolution":{"observed_at":"2026-08-04T20:08:59.968870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:00.052186Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.052186Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:2e6b858e68c2c4a9e585ae064e98843bcfb7f515d9c09920915958f67ff45138","observation_id":"d208184c-7791-4c8a-a987-fc85114cded9","resolution":{"observed_at":"2026-08-04T20:09:00.052186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-04T20:09:00.112624Z","title":"Score-based generative modeling through stochastic differential equations.arXiv preprint arXiv:2011.13456, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.112624Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:8951d05c2acf9846938a85e376c57185fa617b231505c539e5c38162577bcc46","observation_id":"83058bb5-07f5-4989-a8b5-0a2f1f9925b6","resolution":{"observed_at":"2026-08-04T20:09:00.112624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-04T20:09:00.245755Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation.arXiv preprint arXiv:2406.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.245755Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:3414066c4c53f991fffd92ab8794c0dbeef953e28e7a151fd73c53e896c73499","observation_id":"a6df593d-ba6d-4eeb-a27b-ee3828f84c4b","resolution":{"observed_at":"2026-08-04T20:09:00.245755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:00.340485Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.340485Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:a86db957334f9c88efef5081d43f20d04e957f3d58c27deafa4e218037c43755","observation_id":"4b61a4f2-c478-4e5b-bc2e-49d7706edeef","resolution":{"observed_at":"2026-08-04T20:09:00.340485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-04T20:09:00.409906Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.409906Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:ef237830f8a62c17368530a0746d774bdc815de1814415ed318632df084587a1","observation_id":"02bedef1-7f2a-4ce3-bb51-59c74b8c2387","resolution":{"observed_at":"2026-08-04T20:09:00.409906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10527","last_updated":"2025-05-18T17:45:31Z","snapshot_observed_at":"2026-07-06T21:24:34.845524Z","submitted_at":"2025-05-15T17:38:37Z","title":"WorldPM: Scaling Human Preference Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10527","snapshot_observed_at":"2026-08-04T20:09:00.504202Z","title":"Worldpm: Scaling human preference modeling.arXiv preprint arXiv:2505.10527, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.504202Z"},"links":{"cited_paper":"/paper/2505.10527","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:44414b5190b5c19948bd2746569b761f1423e3c80f7528f6a1d0b6797ca80d50","observation_id":"c6887f61-aa82-4a10-9f0e-16a07b78309b","resolution":{"observed_at":"2026-08-04T20:09:00.504202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-04T20:09:00.588199Z","title":"Emu3: Next-token prediction is all you need.arXiv preprint arXiv:2409.18869, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.588199Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:40a640024681fe1e8f737291d70d80e7594691c9a0b24ec550c8956c012240bc","observation_id":"de72a69d-f92c-4349-9115-e5f9f698a074","resolution":{"observed_at":"2026-08-04T20:09:00.588199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:00.663870Z","title":"Unified multimodal chain-of-thought reward model through reinforcement fine-tuning.arXiv preprint arXiv:2505.03318, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.663870Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:ecc9eb22ee4df40ae3daaab3e3e6a153281af13f61299b4d4debd0bc54e91eee","observation_id":"6efd3f03-2a1b-4d8e-b84f-c6ee7772ab80","resolution":{"observed_at":"2026-08-04T20:09:00.663870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05584","last_updated":"2025-02-14T01:21:57Z","snapshot_observed_at":"2026-07-06T19:29:27.705770Z","submitted_at":"2024-10-08T00:52:03Z","title":"Rethinking Reward Model Evaluation: Are We Barking up the Wrong Tree?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05584","snapshot_observed_at":"2026-08-04T20:09:00.786327Z","title":"Rethinking reward model evaluation: Are we barking up the wrong tree?arXiv preprint arXiv:2410.05584, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.786327Z"},"links":{"cited_paper":"/paper/2410.05584","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:12ac591d234d772cfdffd3f8d4f1cee6b6d0339d81725a3884125e88e54d078e","observation_id":"efae6b3f-4095-4f72-8914-968501479d83","resolution":{"observed_at":"2026-08-04T20:09:00.786327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-04T20:09:00.883913Z","title":"Qwen-image technical report.arXiv preprint arXiv:2508.02324, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.883913Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:20db45f79032191c231d4b747b83e6609e94ae38f4bcbc21e2de77349b16d4de","observation_id":"eb924bd3-99c4-4e38-a602-3e7f9fda43e7","resolution":{"observed_at":"2026-08-04T20:09:00.883913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14420","last_updated":"2023-08-22T12:26:07Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T10:09:03Z","title":"Human Preference Score: Better Aligning Text-to-Image Models with Human Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14420","snapshot_observed_at":"2026-08-04T20:09:00.976315Z","title":"Better aligning text-to-image models with human preference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.976315Z"},"links":{"cited_paper":"/paper/2303.14420","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:5c87a6f6fcdd5496d7658d280355e073e2c5200f24d7a3bc5cca55b75957d2a6","observation_id":"46e3a5f9-eca2-47eb-a390-548ed9974217","resolution":{"observed_at":"2026-08-04T20:09:00.976315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.048080Z","title":"Human preference score: Better aligning text-to-image models with human preference","venue":null,"work_id":null,"year":2096},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.048080Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:70eb44114732861204c818a81a346befd479a3dcc62009d1f31a866ed4015f00","observation_id":"2d92b21d-ec74-43a2-b9b2-9b58ff1aa849","resolution":{"observed_at":"2026-08-04T20:09:01.048080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.130666Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.130666Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:a5ad69353e8660a859a879eda6a6f20054b6688d076d74187d178e5a3e1a349c","observation_id":"aa80b625-a1c6-4678-a710-15e30fb59008","resolution":{"observed_at":"2026-08-04T20:09:01.130666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21059","last_updated":"2026-01-05T02:39:01Z","snapshot_observed_at":"2026-08-03T02:30:08.318253Z","submitted_at":"2024-12-30T16:24:09Z","title":"VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21059","snapshot_observed_at":"2026-08-04T20:09:01.179272Z","title":"Visionreward: Fine-grained multi-dimensional human preference learning for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.179272Z"},"links":{"cited_paper":"/paper/2412.21059","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:cb4a85d02546cfce8ab6be8c44693ef73a4dd539f0b8a72b23160712913bc646","observation_id":"5101a8db-ce9f-4fd1-bb50-799474662b82","resolution":{"observed_at":"2026-08-04T20:09:01.179272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04950","last_updated":"2025-04-07T11:34:48Z","snapshot_observed_at":"2026-07-06T21:05:25.007191Z","submitted_at":"2025-04-07T11:34:48Z","title":"A Unified Pairwise Framework for RLHF: Bridging Generative Reward Modeling and Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04950","snapshot_observed_at":"2026-08-04T20:09:01.240055Z","title":"A unified pairwise framework for rlhf: Bridging generative reward modeling and policy optimization.arXiv preprint arXiv:2504.04950, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.240055Z"},"links":{"cited_paper":"/paper/2504.04950","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:90e8460da93b0a301bf079c815f2e1ed800c8e96b14d94f2bde3c8e15c2a537e","observation_id":"96ff8a98-aaa1-4426-84c9-7d72a24e8711","resolution":{"observed_at":"2026-08-04T20:09:01.240055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-07-31T14:51:03.625964Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-08-04T20:09:01.340171Z","title":"Dancegrpo: Unleashing grpo on visual generation.arXiv preprint arXiv:2505.07818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.340171Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:7cc11b781842d2329e509d4e133d5696d53f79762ced6fb753fa4852626bd63d","observation_id":"04c91260-2b23-467c-90c4-d1a0b87aea58","resolution":{"observed_at":"2026-08-04T20:09:01.340171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.438578Z","title":"Schedule on the fly: Diffusion time prediction for faster and better image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.438578Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:dc379db5bf784f3fdc172126992fa4cd42e4469f4a6865086d42470cf5a1bc43","observation_id":"b0c408f1-1a71-4588-a01e-4be385e58372","resolution":{"observed_at":"2026-08-04T20:09:01.438578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.521145Z","title":"Make pixels dance: High-dynamic video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.521145Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:a6a2c627309fd47123a92d6ebb2b82bc23a72fd55169dde7a6da8bf992c8710e","observation_id":"a019f125-4279-4470-a980-f33dec0ff0f8","resolution":{"observed_at":"2026-08-04T20:09:01.521145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.617649Z","title":"Onlinevpo: Align video diffusion model with online video-centric preference optimization.arXiv preprint arXiv:2412.15159, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.617649Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:dfa1aa2731860f32bf9d5e7f23adf5d311d9176a14708cc74a820df0bf239c70","observation_id":"14d30f9e-c529-4d55-86ff-ac7fe409c8c4","resolution":{"observed_at":"2026-08-04T20:09:01.617649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.735214Z","title":"Unifl: Improve latent diffusion model via unified feedback learning.Advances in Neural Information Processing Systems, 37:67355–67382, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.735214Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:d0c9fa0f003c9799743a42138f164c39f5f12a6f9c95c1c0d11b8e055fea0eb5","observation_id":"844e159e-4617-4f71-98e5-b22ea819c96f","resolution":{"observed_at":"2026-08-04T20:09:01.735214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-04T20:09:01.822336Z","title":"Fine-tuning language models from human preferences.arXiv preprint arXiv:1909.08593, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.822336Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:97ce6a8b0d69a3f0c5f4e6f67de66a68f3b5c0fa11cc880cddf5a65317a012a8","observation_id":"a1fc5e6d-cd38-4165-878f-3d41f14e96dd","resolution":{"observed_at":"2026-08-04T20:09:01.822336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T20:08:51.890283Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":72,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 30 inbound Pith citation observations for arXiv:2509.08826."}