{"as_of":"2026-08-06T11:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d9fb702d84f8c51cd9b9ad23482a7f4d3ec21a6adaf416cb1616af920eef8b99","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T16:54:30.953199Z","state":"measured"},{"denominator":110,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":110,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":79,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T16:29:31.429673Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T19:50:11.382174Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2510.16888","last_updated":"2025-11-04T13:15:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-19T15:38:06Z","title":"Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T18:01:19.748677Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2510.16888"},"observation_digest":"sha256:0a06e3fc6d0637cf34ecdbcfe657f0f973d0a8bd68155168d4393d2b1b023e16","observation_id":"041ca52f-8361-42d9-942b-e932235ab501","resolution":{"observed_at":"2026-05-21T18:01:19.936429Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-03T11:36:15.213995Z","title":"Diffusion- nft: Online diffusion reinforcement with forward process","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.05729","last_updated":"2026-05-26T12:06:13Z","snapshot_observed_at":"2026-08-03T11:36:12.571402Z","submitted_at":"2026-01-09T11:15:27Z","title":"TAGRPO: Boosting GRPO on Image-to-Video Generation with Direct Trajectory Alignment","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T11:36:15.213995Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2601.05729"},"observation_digest":"sha256:2214aa82b1ef9d5dd57b1a4f16e42b201f0e8ab5b17a1caa1708fb062bf319e7","observation_id":"a0b86d4b-6801-473c-b07a-fd9ebc189bb4","resolution":{"observed_at":"2026-08-03T11:36:15.213995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-03T07:38:47.338529Z","title":"Diffusionnft: Online diffusion reinforcement with forward process,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.19506","last_updated":"2026-06-30T07:23:59Z","snapshot_observed_at":"2026-08-06T05:25:54.056400Z","submitted_at":"2026-01-27T11:50:31Z","title":"Bridging Information Asymmetry: A Hierarchical Framework for Deterministic Blind Face Restoration","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T07:38:47.338529Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2601.19506"},"observation_digest":"sha256:15620bd8d55b3a8406ea2b46eb57dfa76f953049fcbcbb49f3255e8e6fbf6718","observation_id":"b17e3dad-6831-4e73-a5ec-f797b1cb1685","resolution":{"observed_at":"2026-08-03T07:38:47.338529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-03T03:42:45.779360Z","title":"Diffusion- nft: Online diffusion reinforcement with forward process","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.07345","last_updated":"2026-06-08T05:47:35Z","snapshot_observed_at":"2026-08-03T03:42:42.904784Z","submitted_at":"2026-02-07T04:00:20Z","title":"Optimizing Few-Step Generation with Adaptive Matching Distillation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T03:42:45.779360Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2602.07345"},"observation_digest":"sha256:826902756a885d65bf97505e0f39f7d04fb394f63cb734bef85531f0d323aadb","observation_id":"738b0bb5-a1b9-4e84-aa95-0291161c62e0","resolution":{"observed_at":"2026-08-03T03:42:45.779360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2603.00918","last_updated":"2026-05-10T14:01:21Z","snapshot_observed_at":"2026-07-06T22:47:24.369805Z","submitted_at":"2026-03-01T04:39:09Z","title":"Improving Text-to-Image Generation with Intrinsic Self-Confidence Rewards","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-15T18:40:18.940889Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2603.00918"},"observation_digest":"sha256:278077dd98c2db5eecfd1260a35a9329ba417071a3cf6360e63df85b0583b12d","observation_id":"a1296a26-47ef-49de-bdef-446b06f1333e","resolution":{"observed_at":"2026-05-15T18:41:28.706087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2603.05947","last_updated":"2026-05-12T14:21:56Z","snapshot_observed_at":"2026-08-03T06:30:00.704320Z","submitted_at":"2026-03-06T06:30:34Z","title":"LucidNFT: LR-Anchored Multi-Reward Preference Optimization for Flow-Based Real-World Super-Resolution","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T15:44:54.751000Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2603.05947"},"observation_digest":"sha256:a7eacca84507165cc83d24083a080bff8ffc7863577204ea70f5158c6c52e54e","observation_id":"4d7df37b-3eb7-435e-8da0-b18c71ec7f3d","resolution":{"observed_at":"2026-05-15T15:46:12.285257Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-14T23:47:45.866615Z","title":"flat” landscape to “steep","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.10250","last_updated":"2026-05-24T03:43:13Z","snapshot_observed_at":"2026-07-14T23:47:43.007890Z","submitted_at":"2026-03-10T22:01:13Z","title":"GeMPO: Generalized Measure Matching for Online Diffusion Reinforcement Learning","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-14T23:47:45.866615Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2603.10250"},"observation_digest":"sha256:ae5ad2e3776d3a937f14acbaddf01e73666d1cfc62a5c0c061dbc4b423102858","observation_id":"b20ae49c-0cbb-4252-8d2d-f331c6cea680","resolution":{"observed_at":"2026-07-14T23:47:45.866615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-02T18:25:59.032945Z","title":"Diffusionnft: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.11593","last_updated":"2026-07-17T15:14:37Z","snapshot_observed_at":"2026-08-02T18:25:48.658946Z","submitted_at":"2026-03-12T06:25:09Z","title":"WeEdit: A Dataset, Benchmark and Glyph-Guided Framework for Text-centric Image Editing","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-02T18:25:59.032945Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2603.11593"},"observation_digest":"sha256:e2a0779d31c3d2967fc9ee9909dd38c7f26f1fafc1d985fe5f3fde62835ed3f4","observation_id":"06b307c4-bef8-4c60-994c-6850f400a37d","resolution":{"observed_at":"2026-08-02T18:25:59.032945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2603.21743","last_updated":"2026-05-20T19:52:16Z","snapshot_observed_at":"2026-07-06T22:50:05.914888Z","submitted_at":"2026-03-23T09:33:18Z","title":"CellFluxRL: Biologically-Constrained Virtual Cell Modeling via Reinforcement Learning","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T01:05:45.781048Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2603.21743"},"observation_digest":"sha256:ca2321e09c5dccae827333cb6771b00abc7ca2c1ed0c6bb8a613459724e8ac2a","observation_id":"797b00fe-d66e-42dd-9ddd-f72e7834049d","resolution":{"observed_at":"2026-05-15T01:08:25.859899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2603.21743","last_updated":"2026-05-20T19:52:16Z","snapshot_observed_at":"2026-07-06T22:50:05.914888Z","submitted_at":"2026-03-23T09:33:18Z","title":"CellFluxRL: Biologically-Constrained Virtual Cell Modeling via Reinforcement Learning","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T10:41:37.140709Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2603.21743"},"observation_digest":"sha256:1cba1fa2c06a9efacf667708ffc5e8afe7eb87868e81ddb576e14874253cdb27","observation_id":"1683dc31-dbb9-4377-af63-bc6096b03661","resolution":{"observed_at":"2026-05-22T10:44:47.525707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2604.06916","last_updated":"2026-04-08T10:14:47Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T10:14:47Z","title":"FP4 Explore, BF16 Train: Diffusion Reinforcement Learning via Efficient Rollout Scaling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T18:10:06.994557Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2604.06916"},"observation_digest":"sha256:0d6b4316cd77e03b54c4e2becf0ce8e1244226bd215b6622144d2b18bbff5bed","observation_id":"5d343de5-ace4-4bad-b25a-6ed8d4fe040c","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2604.10954","last_updated":"2026-04-13T03:50:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T03:50:56Z","title":"FineEdit: Fine-Grained Image Edit with Bounding Box Guidance","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T16:15:23.578176Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2604.10954"},"observation_digest":"sha256:85ca34705aaf171e1f5b870bfa44b652c04ae97bb829cf01ab4eab17b399cf14","observation_id":"a885f9a6-339f-460c-a16d-1a3b318db0c1","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2604.15311","last_updated":"2026-05-03T11:22:04Z","snapshot_observed_at":"2026-07-06T23:02:53.677687Z","submitted_at":"2026-04-16T17:59:56Z","title":"LeapAlign: Post-Training Flow Matching Models at Any Generation Step by Building Two-Step Trajectories","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-10T11:23:28.424453Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2604.15311"},"observation_digest":"sha256:20a38ca43bd21a9bd1890977ba0e84bc296a6231907cab4da57c873f2bc7f95d","observation_id":"6bb206a3-1cfe-4c7a-8ecc-8f1e286891b0","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2604.19009","last_updated":"2026-04-21T02:57:13Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T02:57:13Z","title":"Guiding Distribution Matching Distillation with Gradient-Based Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T02:45:35.600729Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2604.19009"},"observation_digest":"sha256:f9e498e72908b83f8e76d2a3293248486589858d1050f02983ccf43731a9b05c","observation_id":"fe5a72f4-ea22-481c-8348-217ec93f57ed","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2604.19039","last_updated":"2026-04-21T03:44:13Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T03:44:13Z","title":"Generative Texture Filtering","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-10T03:16:37.509163Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2604.19039"},"observation_digest":"sha256:aabe4006a9f212be88f82d3822f400233b1fcb01db7484eedf5109e245a0e101","observation_id":"9df95f4f-2e18-460d-93fa-26605d9311f8","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2604.19748","last_updated":"2026-05-10T17:50:28Z","snapshot_observed_at":"2026-08-05T17:00:33.707317Z","submitted_at":"2026-04-21T17:59:49Z","title":"Tstars-Tryon 1.0: Robust and Realistic Virtual Try-On for Diverse Fashion Items","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T03:36:03.906391Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2604.19748"},"observation_digest":"sha256:e6e798e47e2c74682908bb597c4d4e65083f739802e4c9e346bac543912da607","observation_id":"d04b458b-a707-475a-b149-8c0c0d9ca9d6","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2604.19748","last_updated":"2026-05-10T17:50:28Z","snapshot_observed_at":"2026-08-05T17:00:33.707317Z","submitted_at":"2026-04-21T17:59:49Z","title":"Tstars-Tryon 1.0: Robust and Realistic Virtual Try-On for Diverse Fashion Items","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T01:51:23.775478Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2604.19748"},"observation_digest":"sha256:9a924ee7bcc049fdf117c03a2fdc779cd17234ed53e7fdb648e2b4169fe39d97","observation_id":"c7811369-8320-48e9-858c-0e8f26f2f982","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2604.23380","last_updated":"2026-04-25T17:03:21Z","snapshot_observed_at":"2026-07-06T23:09:38.799345Z","submitted_at":"2026-04-25T17:03:21Z","title":"V-GRPO: Online Reinforcement Learning for Denoising Generative Models Is Easier than You Think","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T08:27:17.629238Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2604.23380"},"observation_digest":"sha256:35df9f82bbee5ca9997ea0b37ad63eaaa6a7e426b73a36c21c9e6a90d32417dd","observation_id":"25154744-6234-4ffc-a512-b3314fd02279","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2604.25427","last_updated":"2026-04-28T09:34:51Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T09:34:51Z","title":"A Systematic Post-Train Framework for Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-07T16:58:33.014401Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2604.25427"},"observation_digest":"sha256:5a1d14cdc6d86e1eb3185deecf822a854776e0272940a5d59d754af22ef0ecad","observation_id":"9b4f6aea-76e1-4d66-8d94-02fb5b0ee72f","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.00229","last_updated":"2026-04-30T21:06:46Z","snapshot_observed_at":"2026-07-06T23:13:42.661364Z","submitted_at":"2026-04-30T21:06:46Z","title":"A unified perspective on fine-tuning and sampling with diffusion and flow models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-09T19:43:42.331642Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.00229"},"observation_digest":"sha256:68f56db2c7969a16c89a2b5b6381f14be23e5ca33ab8cb29c722ed0908bc3202","observation_id":"6328fc2e-b632-4bea-b445-84cfa2a82106","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.02641","last_updated":"2026-05-04T14:26:33Z","snapshot_observed_at":"2026-07-06T23:15:41.793878Z","submitted_at":"2026-05-04T14:26:33Z","title":"Mamoda2.5: Enhancing Unified Multimodal Model with DiT-MoE","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T18:26:58.696936Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.02641"},"observation_digest":"sha256:1e8fdf99e183fcba646d08c65888256f7265d3601a2d1ae071e39958f54503f4","observation_id":"a76d68d1-a682-483e-927c-bfe222051121","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.04128","last_updated":"2026-05-20T08:56:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T15:49:47Z","title":"JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-05-08T17:57:08.606559Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.04128"},"observation_digest":"sha256:6fa61ac5d4f866efcc0f0b723e9652651c1b63c56e78cd028b9267d943d611e0","observation_id":"403688aa-645a-47ac-97c9-e04ada8f1db9","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.04128","last_updated":"2026-05-20T08:56:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T15:49:47Z","title":"JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-05-21T08:15:58.020894Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.04128"},"observation_digest":"sha256:2242d8eae491a9b2508de6dd6ac8f1cedf4cbda39c3fd73d2207dfa066a0b7c4","observation_id":"adfcc3d7-e345-44f0-8f06-31ae91d83dd8","resolution":{"observed_at":"2026-05-21T08:19:52.626348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.04494","last_updated":"2026-05-06T04:50:42Z","snapshot_observed_at":"2026-07-31T05:58:54.504742Z","submitted_at":"2026-05-06T04:50:42Z","title":"Towards General Preference Alignment: Diffusion Models at Nash Equilibrium","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T16:54:58.732444Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.04494"},"observation_digest":"sha256:44378d9f580e02b4d04097d52930e360bf64f25b5e38c1f73453a4c40ed897dc","observation_id":"e7772b12-e13e-44bf-a3ed-5346bcc1ef7d","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.05204","last_updated":"2026-05-26T15:05:04Z","snapshot_observed_at":"2026-08-03T09:59:43.729293Z","submitted_at":"2026-05-06T17:59:34Z","title":"D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Models","version":1},"reference_index":117,"source":"pdf_text","source_observed_at":"2026-05-08T17:25:26.391582Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.05204"},"observation_digest":"sha256:15a7f5498d76ca264ec011599431610ad7dddea641fad8d13e53d79a4e361a2f","observation_id":"237d4a6b-cade-40b9-ad0c-045c0646a4e1","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.05204","last_updated":"2026-05-26T15:05:04Z","snapshot_observed_at":"2026-08-03T09:59:43.729293Z","submitted_at":"2026-05-06T17:59:34Z","title":"D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Models","version":2},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-05-20T23:18:35.390642Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.05204"},"observation_digest":"sha256:f9b28adf98adc2abfdcdc6207d5ae8a607e8f809007c49e1964d903f528b9aaa","observation_id":"134eeadf-ef05-466f-b0bc-05f79685d794","resolution":{"observed_at":"2026-05-20T23:19:13.737904Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.05204","last_updated":"2026-05-26T15:05:04Z","snapshot_observed_at":"2026-08-03T09:59:43.729293Z","submitted_at":"2026-05-06T17:59:34Z","title":"D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Models","version":3},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-06-30T23:44:10.302520Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.05204"},"observation_digest":"sha256:5406625f498eb2ef605a699ec761a4e140f49fe461152ed9974e88f4f688f06c","observation_id":"ef38f4dc-789a-45cb-9c3b-75f5be85eebb","resolution":{"observed_at":"2026-06-30T23:45:07.795351Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.07503","last_updated":"2026-05-08T09:37:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-08T09:37:46Z","title":"Diffusion-APO: Trajectory-Aware Direct Preference Alignment for Video Diffusion Transformers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-11T01:58:25.291448Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.07503"},"observation_digest":"sha256:982f22ecf3daac2495563035fe9626d45ae3696f51b2fe1a6ccde460023f3b29","observation_id":"193a290b-47fd-46fc-9e51-1226ac5b7e0c","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-02T18:58:31.704300Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-11T02:04:16.335479Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:b2494115b374155171399ca2c0e76cd5119e322fb4b4ebbf653843af44669795","observation_id":"b79facb1-3293-48c3-b980-44c21d77a8e0","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-02T18:58:31.704300Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T01:17:08.955601Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:f99cc3c29cdf9561548ab115a30d10cdcd22e7f617756de8f12d6a74889e67ea","observation_id":"b9b0d17e-ffef-45fa-b783-993a5c145f0e","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-02T18:58:31.704300Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T05:52:26.736304Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:252e0080f0dfa0182d061927979820dbf62766ab982d048c81f53ba1cb435a49","observation_id":"92d520c6-469a-46ad-8e5d-c9964c7b58c4","resolution":{"observed_at":"2026-05-15T05:55:05.196309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-02T18:58:31.704300Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-20T22:39:32.496303Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:f05a0660d5fb4a623f03af20052d3366c86ccb155e3df45257d43dbfa3d7fb1a","observation_id":"0918f842-0572-42fe-9ce9-d1f377f4cad1","resolution":{"observed_at":"2026-05-20T22:43:51.752168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-02T18:58:31.704300Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:7aede30dc7bb2985133c15d16e03cb79828d57073cc0adc8eaa2c09f0ee2eff0","observation_id":"e8693666-5934-4d0a-bca5-8b80b71f7a5f","resolution":{"observed_at":"2026-06-30T23:05:07.200888Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.08354","last_updated":"2026-05-08T18:05:27Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T18:05:27Z","title":"Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:53.626310Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.08354"},"observation_digest":"sha256:b2306d94465138d4af2abc4009ce7ee72d3a62fa8d55a48c0ec026af330bf5ab","observation_id":"37c8974f-2203-41d6-8cb1-0f07f3b734fb","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.08703","last_updated":"2026-05-09T05:32:48Z","snapshot_observed_at":"2026-08-03T08:47:01.526741Z","submitted_at":"2026-05-09T05:32:48Z","title":"RewardHarness: Self-Evolving Agentic Post-Training","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T01:05:25.567581Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.08703"},"observation_digest":"sha256:3bc6bd979e4c7f983ee5ec1d22b7661db26f6e49ce26eccd90423dce1734078e","observation_id":"98001f8c-bc21-4200-bfbb-ef193c9cd20c","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-07-06T23:22:37.355450Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:2e86b7c24da6b7f61f97266ecf25938fcfaa2aee2584807ad2897e60e0bfbd1a","observation_id":"25775d43-bfe8-4cd4-92d3-744b84d6990b","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.10937","last_updated":"2026-05-11T17:59:25Z","snapshot_observed_at":"2026-07-06T23:22:52.369277Z","submitted_at":"2026-05-11T17:59:25Z","title":"Power Reinforcement Post-Training of Text-to-Image Models with Super-Linear Advantage Shaping","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:40.994346Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.10937"},"observation_digest":"sha256:a09b134cdaf4faafd1693f14fd90884fc5a070b440cc5d66298846d77b37830f","observation_id":"c8826ad7-adfa-4e75-b081-4ba381ddbd2b","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.12112","last_updated":"2026-05-12T13:29:10Z","snapshot_observed_at":"2026-07-06T23:23:48.960874Z","submitted_at":"2026-05-12T13:29:10Z","title":"When Policy Entropy Constraint Fails: Preserving Diversity in Flow-based RLHF via Perceptual Entropy","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-13T05:50:13.653022Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.12112"},"observation_digest":"sha256:f52a729003593d5e993848c0b2677f6ebe352979dc23ec4e6dd805df53d55d35","observation_id":"779b8ea3-2730-435f-b0f3-94812f1f4c3f","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-12T16:57:23.214654Z","title":"Diffusionnft: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.12479","last_updated":"2026-07-06T08:55:19Z","snapshot_observed_at":"2026-07-12T16:57:22.059952Z","submitted_at":"2026-05-12T17:56:29Z","title":"Cutting rules in strong field QED with application to trident pair production","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T16:57:23.214654Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.12479"},"observation_digest":"sha256:f78585be29f9cc7c305eb54a67e0c2e90c0e2a9d8f520e3ab4a75d9a213dfaf8","observation_id":"be15b09b-6310-4b81-bf0f-4d095500b7ce","resolution":{"observed_at":"2026-07-12T16:57:23.214654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.12480","last_updated":"2026-05-12T17:56:59Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:56:59Z","title":"OmniNFT: Modality-wise Omni Diffusion Reinforcement for Joint Audio-Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T06:16:20.612291Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.12480"},"observation_digest":"sha256:7facfc40ba3198c61e300508317c2a380b203b0d7c34d80089926f28c98dc2b0","observation_id":"d092edc2-7126-4bbd-8918-0df2b68d53bd","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.14274","last_updated":"2026-05-14T02:18:58Z","snapshot_observed_at":"2026-08-02T20:54:21.208623Z","submitted_at":"2026-05-14T02:18:58Z","title":"CreFlow: Corrective Reflow for Sparse-Reward Embodied Video Diffusion RL","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T02:42:08.454469Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.14274"},"observation_digest":"sha256:f8eb17f9f5f2fa85e75e6fc550022a6a690a871f37f59219b43bb32d75965c1e","observation_id":"2c820e11-6079-49ce-b66a-00e5e31302ab","resolution":{"observed_at":"2026-05-15T02:43:33.282486Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.14876","last_updated":"2026-05-15T05:10:39Z","snapshot_observed_at":"2026-08-02T23:16:15.609028Z","submitted_at":"2026-05-14T14:22:25Z","title":"Unlocking Complex Visual Generation via Closed-Loop Verified Reasoning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-19T16:35:43.166697Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.14876"},"observation_digest":"sha256:135e144dcd11ed98dcf48df48a1146d520d9a1d246c777b27c77319a0969b759","observation_id":"53d44aaf-8457-4425-ba0c-3aa11d5ee317","resolution":{"observed_at":"2026-05-19T16:37:39.696477Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.15055","last_updated":"2026-05-14T16:49:09Z","snapshot_observed_at":"2026-08-01T03:43:04.469611Z","submitted_at":"2026-05-14T16:49:09Z","title":"DiffusionOPD: A Unified Perspective of On-Policy Distillation in Diffusion Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T21:20:23.420424Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.15055"},"observation_digest":"sha256:ece92ae1a97ca5d80597cc3f5a6e634da6a236fe91f5f27f3c54efd2833fd543","observation_id":"f755778f-cfea-4963-9c97-33f530a7167a","resolution":{"observed_at":"2026-07-01T14:25:46.847490Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.15803","last_updated":"2026-05-15T09:56:40Z","snapshot_observed_at":"2026-07-06T23:27:01.213106Z","submitted_at":"2026-05-15T09:56:40Z","title":"Embedding-perturbed Exploration Preference Optimization for Flow Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-20T18:33:52.933672Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.15803"},"observation_digest":"sha256:8845faf22cb1b3b1027ae9a785071ab7f77321e6e4ec7c803754cdccc201cf04","observation_id":"15756214-6d56-4c10-818e-d09873d117cc","resolution":{"observed_at":"2026-05-20T18:38:52.968583Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.16951","last_updated":"2026-05-16T12:05:39Z","snapshot_observed_at":"2026-08-02T16:28:04.937142Z","submitted_at":"2026-05-16T12:05:39Z","title":"Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-19T20:44:54.356658Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.16951"},"observation_digest":"sha256:fad14e0f24bec08febcc8e5c9dbf541702eb87b621e89cc4ec63601096cf49e2","observation_id":"bbcddf5a-7642-4de7-b0c3-e3ab929ce4cd","resolution":{"observed_at":"2026-05-19T20:47:45.861784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.18678","last_updated":"2026-05-20T11:14:23Z","snapshot_observed_at":"2026-08-04T16:01:22.114748Z","submitted_at":"2026-05-18T17:18:24Z","title":"Lance: Unified Multimodal Modeling by Multi-Task Synergy","version":1},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-05-20T11:46:52.658984Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.18678"},"observation_digest":"sha256:a0f3458149c9ce38ee991f3f44df080f25fcc6ec503f4d2aac213a4a85dc04f2","observation_id":"6a6ca34e-16e8-42f3-9e41-15081b8997b0","resolution":{"observed_at":"2026-05-20T11:48:14.956010Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.18678","last_updated":"2026-05-20T11:14:23Z","snapshot_observed_at":"2026-08-04T16:01:22.114748Z","submitted_at":"2026-05-18T17:18:24Z","title":"Lance: Unified Multimodal Modeling by Multi-Task Synergy","version":2},"reference_index":150,"source":"pdf_text","source_observed_at":"2026-05-21T07:56:34.034047Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.18678"},"observation_digest":"sha256:119d46a02e22427eeaf12e116ff4f786b9b8c23809316fe89bdd722a0997bcdb","observation_id":"b58532f2-2c9d-4342-9543-2a02ef384466","resolution":{"observed_at":"2026-05-21T07:59:50.542832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.21573","last_updated":"2026-05-20T17:59:58Z","snapshot_observed_at":"2026-08-02T08:45:09.575827Z","submitted_at":"2026-05-20T17:59:58Z","title":"Lens: Rethinking Training Efficiency for Foundational Text-to-Image Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T09:34:14.596976Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.21573"},"observation_digest":"sha256:84164fcedda463d6f10b14951e9729c4fc9a032ad7c0519bbddd3c8182e693ca","observation_id":"3fa1a167-6cd4-4348-a711-981a87f86153","resolution":{"observed_at":"2026-05-22T09:34:46.721221Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.23346","last_updated":"2026-05-22T08:06:52Z","snapshot_observed_at":"2026-07-06T23:33:34.409634Z","submitted_at":"2026-05-22T08:06:52Z","title":"Contrastive Distribution Matching for Amortized Sequential Monte Carlo in Discrete Diffusion","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-25T05:30:15.053277Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.23346"},"observation_digest":"sha256:ecc8abfc1f98e3620eceb1a45768f246e1e6365ab13bb9de3f09cda8cb58358a","observation_id":"2f20a9ae-53fb-4663-897b-a00c3fbe8dbe","resolution":{"observed_at":"2026-05-25T05:30:22.480778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.23407","last_updated":"2026-05-22T09:17:11Z","snapshot_observed_at":"2026-07-31T22:28:17.481344Z","submitted_at":"2026-05-22T09:17:11Z","title":"GeoCycler: Reward-Aligned 3D Diffusion for Constraint-Conditioned Cyclic Peptide Design","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-25T02:46:03.894997Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.23407"},"observation_digest":"sha256:16e160282f7d95496c134e92abe5e269c2bdfe1113b484e14f3a7eb7dd1bd60a","observation_id":"36b93a51-861b-455c-8fdc-782f8b944f46","resolution":{"observed_at":"2026-05-25T02:46:33.465077Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.23522","last_updated":"2026-05-22T11:37:22Z","snapshot_observed_at":"2026-08-06T01:21:06.575636Z","submitted_at":"2026-05-22T11:37:22Z","title":"Precise: SDE-Consistent Stochastic Sampling for RL Post-Training of Flow-Matching Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-25T05:05:09.178674Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.23522"},"observation_digest":"sha256:1c4ba38226d0b8d7b9dfe17f5ccf27e785f4529ba34909ae517a7926b87b8840","observation_id":"22610273-e326-4f7a-8e9b-eea88aa558d4","resolution":{"observed_at":"2026-05-25T05:05:22.171484Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.26013","last_updated":"2026-05-25T16:32:14Z","snapshot_observed_at":"2026-08-02T15:05:50.635281Z","submitted_at":"2026-05-25T16:32:14Z","title":"AdvantageFlow: Advantage-Weighted Least Squares for RL in Flow Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T22:44:25.152451Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.26013"},"observation_digest":"sha256:868bcb7472c0de9ebe48d2b7621ab1643fae8ec1ac0cd6fa93a57c98d4e34b02","observation_id":"6d82f758-7150-47f3-ae3b-571ab367f929","resolution":{"observed_at":"2026-06-29T22:54:01.601778Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.26552","last_updated":"2026-05-27T07:59:16Z","snapshot_observed_at":"2026-07-06T23:36:25.432687Z","submitted_at":"2026-05-26T05:02:49Z","title":"Aligning Few-Step Generative Models by Amortizing Sample-based Variational Inference","version":2},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-06-29T19:17:17.682142Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.26552"},"observation_digest":"sha256:28aea541b1d5ba35d53a97a27f601566d0eddacebda208e70a834e0ae8cb6fb1","observation_id":"2aafe461-0848-4f48-82f0-a23d5cd22fdd","resolution":{"observed_at":"2026-06-29T19:23:54.034067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.28691","last_updated":"2026-05-27T16:19:45Z","snapshot_observed_at":"2026-07-06T23:38:14.056361Z","submitted_at":"2026-05-27T16:19:45Z","title":"OSP-Next: Efficient High-Quality Video Generation with Sparse Sequence Parallelism, HiF8 Quantization, and Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T13:06:02.201607Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.28691"},"observation_digest":"sha256:4ecb3d91fd3ed76131173ef2ea2d9957036e8ae666cf85228223ff810dffae05","observation_id":"c7ec2534-5536-47a9-8c83-af5830c8357e","resolution":{"observed_at":"2026-06-29T13:13:27.541055Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.29198","last_updated":"2026-05-29T15:12:05Z","snapshot_observed_at":"2026-07-06T23:38:37.178378Z","submitted_at":"2026-05-28T00:17:49Z","title":"Guidance Contrastive Token Credit Assignment for Discrete Policy Optimization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-29T08:59:03.375697Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.29198"},"observation_digest":"sha256:d8dc62275261353cf63003a50a50dff2c8763d05bb7b7a7ad57a02a1040df17b","observation_id":"d1565b96-4356-4b95-aa4f-e0618eb1da5c","resolution":{"observed_at":"2026-06-29T09:03:15.916798Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.29398","last_updated":"2026-05-28T05:47:40Z","snapshot_observed_at":"2026-07-06T23:38:51.349968Z","submitted_at":"2026-05-28T05:47:40Z","title":"GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-29T08:44:53.969301Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.29398"},"observation_digest":"sha256:258f4cc47dca08bef29c3f00d3246b517130504c8e70c755c636faa0eb30fd34","observation_id":"cd8f7959-137b-4409-a7b4-1671459555cd","resolution":{"observed_at":"2026-06-29T08:53:16.390258Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.30991","last_updated":"2026-05-29T08:26:14Z","snapshot_observed_at":"2026-08-06T09:35:21.974621Z","submitted_at":"2026-05-29T08:26:14Z","title":"Parallel Tempering Initial Sampling in Inference-Time Reward Alignment","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T23:28:22.532621Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.30991"},"observation_digest":"sha256:0e836b6468deb5a36a626ebee66ff376a49f175b1abb39607acb5ed7b21cd073","observation_id":"dddcc74d-4b9c-436c-a787-bff677d262c8","resolution":{"observed_at":"2026-06-28T23:32:47.426655Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.30993","last_updated":"2026-05-29T08:27:57Z","snapshot_observed_at":"2026-08-02T00:55:15.607531Z","submitted_at":"2026-05-29T08:27:57Z","title":"SwanVoice: Expressive Long-Form Zero-Shot Speech Synthesis for Both Monologue and Dialogue","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T21:05:54.061395Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.30993"},"observation_digest":"sha256:49385d65cbfd2f872309038228877a9eb52707c7caf1adb41b70b3bc1e1570a8","observation_id":"8c360d91-4310-4c02-b2ac-6041e8b15518","resolution":{"observed_at":"2026-07-01T20:26:13.147669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2606.12072","last_updated":"2026-06-10T13:40:19Z","snapshot_observed_at":"2026-08-02T21:32:50.432496Z","submitted_at":"2026-06-10T13:40:19Z","title":"World Model Self-Distillation: Training World Models to Solve General Tasks","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T10:16:35.511426Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.12072"},"observation_digest":"sha256:045575810285cc4d670d38211f4388afbf61b41881acfaaee4c35dda8ebe1695","observation_id":"d1eaa7c2-ba76-4a47-b845-8047652e5a6a","resolution":{"observed_at":"2026-07-03T10:07:55.850444Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2606.17800","last_updated":"2026-06-16T11:25:37Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:25:37Z","title":"MaineCoon: Pursuing A Real-Time Audio-Visual Social World Model","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-27T01:09:02.214590Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.17800"},"observation_digest":"sha256:3e9d130fe99c1e76f773057de8b1501370efc270ed1144a7b92436416db192db","observation_id":"0b5ccfd4-ed3d-4732-9302-09a5573ec089","resolution":{"observed_at":"2026-07-03T20:48:55.696397Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2606.22568","last_updated":"2026-07-28T14:00:33Z","snapshot_observed_at":"2026-08-02T20:00:36.611805Z","submitted_at":"2026-06-21T16:10:22Z","title":"SeFi-Image: A Text-to-Image Foundation Model with Semantic-First Diffusion","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T11:13:14.328220Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.22568"},"observation_digest":"sha256:f3bfd21eaeecfa1622f01461ceedc12618c1faf67e278d1a6437a91fa9d06641","observation_id":"dc6b5b1a-c076-47a7-9176-820446180ca1","resolution":{"observed_at":"2026-07-04T08:39:42.145285Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2606.22568","last_updated":"2026-07-28T14:00:33Z","snapshot_observed_at":"2026-08-02T20:00:36.611805Z","submitted_at":"2026-06-21T16:10:22Z","title":"SeFi-Image: A Text-to-Image Foundation Model with Semantic-First Diffusion","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T05:19:29.719934Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.22568"},"observation_digest":"sha256:fa65e5df4277d7b6cc8e1aefed8e088e3bb8f776c8b6989a2e2a21ee420bde83","observation_id":"cf856df9-db44-44e4-a34d-91dc2b3b6c25","resolution":{"observed_at":"2026-06-29T17:13:45.438343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-02T10:38:02.432407Z","title":"Diffusionnft: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22568","last_updated":"2026-07-28T14:00:33Z","snapshot_observed_at":"2026-08-02T20:00:36.611805Z","submitted_at":"2026-06-21T16:10:22Z","title":"SeFi-Image: A Text-to-Image Foundation Model with Semantic-First Diffusion","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T10:38:02.432407Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.22568"},"observation_digest":"sha256:1bc537b7e87da6dff8dd1c0cab2eb7b6aaf7bd84eed9fd893f78cc23ad9359eb","observation_id":"75e6c51d-8734-482d-bfa7-4c1fef3704f5","resolution":{"observed_at":"2026-08-02T10:38:02.432407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2606.25473","last_updated":"2026-06-24T06:58:02Z","snapshot_observed_at":"2026-08-05T22:45:50.916812Z","submitted_at":"2026-06-24T06:58:02Z","title":"Causal-rCM: A Unified Teacher-Forcing and Self-Forcing Open Recipe for Autoregressive Diffusion Distillation in Streaming Video Generation and Interactive World Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-25T20:57:30.765802Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.25473"},"observation_digest":"sha256:9f7514ed8e88cae7e46b9a9feab0e42ac225a37818f3d3a0bc99c3220542cde6","observation_id":"73e08bf2-5fd5-41f8-891b-a8edcb773476","resolution":{"observed_at":"2026-07-04T19:50:11.383320Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2606.27608","last_updated":"2026-06-25T23:49:50Z","snapshot_observed_at":"2026-07-07T00:01:49.598947Z","submitted_at":"2026-06-25T23:49:50Z","title":"Qwen-Image-2.0-RL Technical Report","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T01:11:12.757656Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.27608"},"observation_digest":"sha256:4c4cd065b2cdb4e2d261b00847c911659d08ea3f46d4c8aba06128a7e61cd2d8","observation_id":"627034c1-f275-4fcf-9cbb-1462961fd612","resolution":{"observed_at":"2026-07-01T19:06:02.848907Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2606.27752","last_updated":"2026-06-26T06:15:04Z","snapshot_observed_at":"2026-07-07T00:01:54.432346Z","submitted_at":"2026-06-26T06:15:04Z","title":"PerturbCellRL: Verifier-Guided Reinforcement Learning for Single-Cell Perturbation Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T05:11:09.189141Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.27752"},"observation_digest":"sha256:52ffd50938e914ed438e7b8ea9a717e115446c5ff5847ec5020c4bb2767211e5","observation_id":"9c42bcab-93e2-463a-91e2-adcfbe5819be","resolution":{"observed_at":"2026-06-29T18:13:49.481187Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2606.27771","last_updated":"2026-08-05T07:56:11Z","snapshot_observed_at":"2026-08-06T10:29:17.552941Z","submitted_at":"2026-06-26T06:56:54Z","title":"NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T05:00:04.037802Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.27771"},"observation_digest":"sha256:86b4cd759f1fd37af378e98a1977ef61cad99e3597ebbec927abb55d0d46f94e","observation_id":"4ed72780-514f-45c5-8e1a-7036b14b7a17","resolution":{"observed_at":"2026-06-29T19:03:51.744430Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-12T11:38:13.566600Z","title":"Image Realism Judge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27771","last_updated":"2026-08-05T07:56:11Z","snapshot_observed_at":"2026-08-06T10:29:17.552941Z","submitted_at":"2026-06-26T06:56:54Z","title":"NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T11:38:13.566600Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.27771"},"observation_digest":"sha256:60598818cbd0325b1536f2f49ee0d44ae9bc358d5c087da137698e7626d216b4","observation_id":"c45a2a27-10ba-4b16-9a45-21cd9585b40c","resolution":{"observed_at":"2026-07-12T11:38:13.566600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-02T09:56:25.942792Z","title":"Image Realism Judge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27771","last_updated":"2026-08-05T07:56:11Z","snapshot_observed_at":"2026-08-06T10:29:17.552941Z","submitted_at":"2026-06-26T06:56:54Z","title":"NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T09:56:25.942792Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.27771"},"observation_digest":"sha256:c059b63df50f896ff1b5b3fadaf74d8cc8359b0e974fd9d5dcac29ac0eb0c290","observation_id":"e36b6c4c-fe52-4459-aad9-8e924adf5df2","resolution":{"observed_at":"2026-08-02T09:56:25.942792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2606.30376","last_updated":"2026-06-29T14:37:36Z","snapshot_observed_at":"2026-07-07T00:04:15.048683Z","submitted_at":"2026-06-29T14:37:36Z","title":"FlowAWR: Online Adaptive Flow Reinforcement via Advantage-Weighted Rectification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T07:10:44.244790Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2606.30376"},"observation_digest":"sha256:cbf5b595fbee0de51c04890fd53a255c0da0fb3a39355756260ca7ade1cd3661","observation_id":"01d12302-20d4-4289-9cd1-e126510b5729","resolution":{"observed_at":"2026-06-30T07:14:20.971530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2607.02220","last_updated":"2026-07-02T14:26:47Z","snapshot_observed_at":"2026-08-01T18:29:16.831004Z","submitted_at":"2026-07-02T14:26:47Z","title":"DetailAnywhere: Fashion Detail Generation via Cross-Modal Feature Alignment Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-03T15:56:38.037304Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2607.02220"},"observation_digest":"sha256:fd151bc8671a96a414530f253ce9d29dbc5068fd534d21bcc4ad14ef05e72289","observation_id":"d50855f6-fc2d-4607-a08b-b7488e4f771c","resolution":{"observed_at":"2026-07-03T15:58:37.297939Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-12T00:14:19.104498Z","title":"Diffusionnft: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03748","last_updated":"2026-07-04T07:40:43Z","snapshot_observed_at":"2026-08-02T09:22:47.161760Z","submitted_at":"2026-07-04T07:40:43Z","title":"Bridging Interleaved Multi-Modal Reasoning as a Unified Decision Process","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T00:14:19.104498Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2607.03748"},"observation_digest":"sha256:387a911b79e4d4c53ca54cf3d509978dd77f29eb9b6af2a04b7c6925ab3119e7","observation_id":"498cfbbd-2378-43ff-8236-bd4292643df9","resolution":{"observed_at":"2026-07-12T00:14:19.104498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-14T03:58:47.052341Z","title":"DiffusionNFT: Online diffusion reinforcement with forward process,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11673","last_updated":"2026-07-14T04:32:07Z","snapshot_observed_at":"2026-08-05T22:34:48.460731Z","submitted_at":"2026-07-13T15:14:48Z","title":"ABot-3DWorld 0: A Universal World Model to Explore Any 3D Space","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T03:58:47.052341Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2607.11673"},"observation_digest":"sha256:de41ca27886922bee148af82edc6c65803c8df19895f57ed9ac2e5b4eb459057","observation_id":"4fea896e-f570-404f-9d6a-fb5b465c2f4e","resolution":{"observed_at":"2026-07-14T03:58:47.052341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-01T20:30:44.499015Z","title":"Zheng, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16602","last_updated":"2026-07-21T07:58:44Z","snapshot_observed_at":"2026-08-06T06:19:35.337752Z","submitted_at":"2026-07-18T02:42:27Z","title":"PAVXploreRL: Physical-Action-Visual World Model Reinforcement Learning with Action Exploration","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T20:30:44.499015Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2607.16602"},"observation_digest":"sha256:5c9ea9bb7d974cc93261f0c5305d454d815dd905285bc75754f152157901d921","observation_id":"f6ffa1e8-1b9b-43e3-9dcf-5b0da6407561","resolution":{"observed_at":"2026-08-01T20:30:44.499015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-01T17:41:03.898241Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17572","last_updated":"2026-07-25T08:59:31Z","snapshot_observed_at":"2026-08-03T13:23:48.122079Z","submitted_at":"2026-07-20T05:30:40Z","title":"JAGG: Jacobian-Aggregated Group Gradient for Efficient GRPO Training of Diffusion Models","version":3},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-01T17:41:03.898241Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2607.17572"},"observation_digest":"sha256:595bb1f652d3fc1b3ed92627a6918335bbe2dd3aa7e6564933c45d9066531e97","observation_id":"98ddbe36-96fe-4644-9b66-9659f186cfbb","resolution":{"observed_at":"2026-08-01T17:41:03.898241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-01T13:38:57.629394Z","title":"DiffusionNFT: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-06T06:06:33.902183Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.629394Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:e37786dbd495a212d5c68259ccb268f66648b0b43749ace1b53cd629073ff065","observation_id":"2480606f-bc55-4b33-9b7b-ecea6f2b8686","resolution":{"observed_at":"2026-08-01T13:38:57.629394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-01T07:07:13.586343Z","title":"Diffusionnft: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21694","last_updated":"2026-07-23T17:45:56Z","snapshot_observed_at":"2026-08-04T23:21:36.009385Z","submitted_at":"2026-07-23T17:45:56Z","title":"Oxygen-TryOn: Fashion-Native Foundation Model for Any-item Virtual Try-On","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T07:07:13.586343Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2607.21694"},"observation_digest":"sha256:78646d30abacf0312bfb04e56aff481c187fe47585fe63af342f24668b044d8d","observation_id":"b12dfc64-932d-438d-8a3b-17a47a48d325","resolution":{"observed_at":"2026-08-01T07:07:13.586343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-31T12:31:29.711276Z","title":"Diffusionnft: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24522","last_updated":"2026-07-27T15:03:22Z","snapshot_observed_at":"2026-08-02T23:21:26.032487Z","submitted_at":"2026-07-27T15:03:22Z","title":"FlowCTS: On-policy Continuous Trajectory Supervision of Flow Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T12:31:29.711276Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2607.24522"},"observation_digest":"sha256:6cb7a7a4bc50b70acfa7ca829d738a75f7c27dda6c0c0d586430233426448cc6","observation_id":"f0010592-1585-4e5e-873e-e5296b7eb444","resolution":{"observed_at":"2026-07-31T12:31:29.711276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-04T16:29:31.429673Z","title":"Diffusionnft: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02023","last_updated":"2026-08-04T08:54:48Z","snapshot_observed_at":"2026-08-06T10:25:19.924438Z","submitted_at":"2026-08-03T10:20:52Z","title":"SwanTale: Unified Multi-Speaker Speech and Audio Generation for Instruct and Zero-Shot Tasks","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-08-04T16:29:31.429673Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2608.02023"},"observation_digest":"sha256:320432e2234d7001dd4d6ec17f9099632efb65e5cd0c9e2824c369285e82dfe7","observation_id":"3d525ebd-deab-45ae-83b9-5f151015bda1","resolution":{"observed_at":"2026-08-04T16:29:31.429673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.16117/citation-record","integrity":"/paper/2509.16117/integrity","json":"/paper/2509.16117/citation-record.json","paper":"/paper/2509.16117"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:3dfb43dfcc63892771e2e7e12e12ed6eb6f44a5df0d40dd888e7ff6f311fcfb3","observation_id":"139df65c-0428-47f3-8bd0-ccc5a605dcc9","resolution":{"observed_at":"2026-05-13T16:54:30.969512Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-01T15:43:51.739518Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2305.13301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-07-08T19:25:32.506868Z","title":"Training Diffusion Models with Reinforcement Learning","venue":"cs.LG","work_id":"67684dda-3930-452a-b91a-36cbb8e2e219","year":2023},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:7714822a4025b27189c7e70cb302f744f148dcfbaecf40f6a61a8061999b8fd7","observation_id":"662b90d9-79ac-4858-a45e-eb2cba7e9998","resolution":{"observed_at":"2026-05-13T16:54:30.972871Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.18116","doi":"10.48550/arxiv.2505.18116","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bridging supervised learning and reinforcement learning in math reasoning","venue":"arXiv (Cornell University)","work_id":"17a80866-5922-4fc3-bd6b-ba617c51052b","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:791ac54b1cc3f1aa140ad84d9352cb0bfedf4bdb1ac308ba9ded2ea0a055dcdc","observation_id":"829aedec-ad5e-46e9-96db-d3cd034adb58","resolution":{"observed_at":"2026-05-13T16:54:30.976104Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dpok: Reinforcement learning for fine-tuning text-to-image diffusion models.Advances in Neural Information Processing Systems, 36:79858–79885","venue":null,"work_id":"41e4c5d6-b329-40bf-8dc0-164fcb2ad802","year":2026},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:d5125192b9e6ce1efc6e0a327fd31421438914a84b6e910b544e46b0db1ded1c","observation_id":"9774b4c3-e85f-47cd-b82d-dc3513ba3fb7","resolution":{"observed_at":"2026-05-13T16:54:31.045211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23458","last_updated":"2025-05-29T14:06:50Z","snapshot_observed_at":"2026-07-06T21:32:57.510891Z","submitted_at":"2025-05-29T14:06:50Z","title":"Diffusion Guidance Is a Controllable Policy Improvement Operator","version":1},"cited_work":{"arxiv_id":"2505.23458","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23458","snapshot_observed_at":"2026-07-04T16:39:58.122193Z","title":"Diffusion guidance is a controllable policy im- provement operator.arXiv preprint arXiv:2505.23458","venue":null,"work_id":"85c1b3dc-42d2-4b34-9b85-9da92334b592","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2505.23458","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:f7ba756a7096dab7573c761324a32aab1dce3ce7a566d4bfb00240269b671217","observation_id":"e09793a3-be45-46dd-ab6f-0509b118ac7c","resolution":{"observed_at":"2026-05-13T16:54:30.998401Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:270ac42a38feacd7194bf0ad93b4980736a3baf13b60eae6cef213c350bca7aa","observation_id":"08f3f541-d2f6-4eca-ab02-ca8d6a3663ac","resolution":{"observed_at":"2026-05-13T16:54:31.001557Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":"2104.08718","doi":"10.48550/arxiv.2104.08718","metadata_source":"pith","pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","venue":"cs.CV","work_id":"2dd7e0b7-c69c-4976-a406-12d4f5b18d14","year":2021},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:9a83b8bd548aa4af2c82f058ebdd67616a9bf7bb5eb405395c6b9a8cd14385f0","observation_id":"0d4ecbe7-5b4f-485d-97d3-e24d947f4914","resolution":{"observed_at":"2026-05-13T16:54:31.004646Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":"2207.12598","doi":"10.1109/cvpr52733.2024.02494","metadata_source":"pith","pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Classifier-Free Diffusion Guidance","venue":"cs.LG","work_id":"acf2c588-c088-4a6c-938e-150ad7c666d7","year":2022},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:5345176fa1ab761c2830eb236bb210f912a6fc1d54cab47287a0bf7daaac995e","observation_id":"8ebfa2b7-940f-4a55-a70c-82fa718c2055","resolution":{"observed_at":"2026-05-13T16:54:31.007319Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"cited_work":{"arxiv_id":"2508.21016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21016","snapshot_observed_at":"2026-06-30T07:14:20.959214Z","title":"Inference-time alignment control for diffusion models with reinforcement learning guidance","venue":null,"work_id":"cb0aeaa8-80a2-4b68-8b5a-e8737cdce98b","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2508.21016","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:b2191da27115cc4229c8f1f88574ed6d7f13692e3b6b5a875b8f2c47fef58bc0","observation_id":"6674a156-2fbb-43f2-9c5f-0341df19c5b6","resolution":{"observed_at":"2026-05-13T16:54:31.010581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":"2302.12192","doi":"10.48550/arxiv.2302.12192","metadata_source":"pith","pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aligning Text-to-Image Models using Human Feedback","venue":"cs.LG","work_id":"39a08cdc-3986-4994-baf0-91e8ddf1b855","year":2023},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:346407efa662e6e504e80a34e4ef3177ccba3b97e804ee11847ce41729bd497a","observation_id":"666398f7-49e8-4918-b88e-196b1ddb07eb","resolution":{"observed_at":"2026-05-14T20:39:15.590122Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00909","last_updated":"2018-05-20T20:03:59Z","snapshot_observed_at":"2026-07-06T06:37:02.085757Z","submitted_at":"2018-05-02T17:11:20Z","title":"Reinforcement Learning and Control as Probabilistic Inference: Tutorial and Review","version":3},"cited_work":{"arxiv_id":"1805.00909","doi":"10.4249/scholarpedia.1658.url:http://www.scholarpedia","metadata_source":"pith","pith_arxiv_id":"1805.00909","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Reinforcement Learning and Control as Probabilistic Inference: Tutorial and Review","venue":"cs.LG","work_id":"e29031ac-37fe-4702-86de-bb869d1f5c9a","year":2018},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/1805.00909","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:64d98cffcb5768f2398edebebc73a271070fc1e560c11e6dc4dd59e7fa614670","observation_id":"d948cab9-2bd9-44fd-805e-896b35ce92aa","resolution":{"observed_at":"2026-05-13T18:27:03.097041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.07510","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:43:54.806176Z","title":"arXiv preprint arXiv:2507.07510 , year=","venue":null,"work_id":"2440b95b-ef2d-45ea-82cd-ece85021386d","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:3de6dd2235b8d92be997e3463f5f955fbc39f0039dc9923b00c62b45563003ab","observation_id":"1bc4cf71-7dea-4249-ad1b-17a6561c1363","resolution":{"observed_at":"2026-05-13T16:54:31.019743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:bf754f81005d4b9cc297b1b4e23bb3e1285ba201b72078afbb6a1ef7b5c4a396","observation_id":"e257db46-8f45-4a3e-8254-6a728a86e4ee","resolution":{"observed_at":"2026-05-13T16:54:31.022380Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-06T11:11:00.378627Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":"2505.05470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-07-09T02:25:55.898592Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","venue":"cs.CV","work_id":"bf1e8e81-ff31-401a-a5dc-d9c49df168ab","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:3e8798c3e0a915ea3b79b1455fa9309c4eb25a5d2a7d98d0e24a3f0a88e4cbd6","observation_id":"954f5b36-d10f-4dea-b58e-32271cd7488b","resolution":{"observed_at":"2026-05-13T16:54:31.025107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":"2209.03003","doi":"10.48550/arxiv.2209.03003","metadata_source":"pith","pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","venue":"cs.LG","work_id":"a1989e1b-d66d-4533-be3a-fb9c5fd62290","year":2022},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:d41114350ed57e4b702768fd12da0463caa21e99e999f90db3c7adce89301c1b","observation_id":"643ff579-85bd-4879-8c41-f5955b319e5e","resolution":{"observed_at":"2026-05-13T16:54:31.028117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-07-29T20:17:21.488997Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2211.01095","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-07-11T01:57:50.075044Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","venue":"cs.LG","work_id":"a7e16614-fbfc-45d6-8fb6-714035cb707c","year":2022},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:beac10b2088bd88d19e98b23227ea21c300db999be5483f9abf55a1f271913f5","observation_id":"5888bd0c-b5d3-4fdd-a454-06e36fae59f5","resolution":{"observed_at":"2026-05-16T07:54:11.877839Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08737","last_updated":"2024-07-11T17:59:45Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:45Z","title":"Video Diffusion Alignment via Reward Gradients","version":1},"cited_work":{"arxiv_id":"2407.08737","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.08737","snapshot_observed_at":"2026-07-09T02:25:55.920956Z","title":"Video diffusion alignment via reward gradients","venue":"cs.CV","work_id":"04c1f131-6850-482c-af3e-1e6310b65297","year":2024},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2407.08737","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:5c8923fe0047e1b1eb5aa02f10f7676767ae9e77ad235d234166c1c88a193717","observation_id":"f450e44f-0e3a-4bb5-ab2f-fa1866fa9d2b","resolution":{"observed_at":"2026-05-13T16:54:31.034781Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:fa7981e6b4918c6fc4c8d4e89bf6c67c079759c339430bcd5ecc1573d0985033","observation_id":"6bc7b6d4-3bf4-4ee8-9d86-82c3999b5add","resolution":{"observed_at":"2026-05-13T16:54:31.037691Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:674ae2c30e9a79bbd7d2905d51a86e657cb6235a578b90a649cda2a403f04a77","observation_id":"b20570a1-271b-4f19-870e-3556dd227324","resolution":{"observed_at":"2026-05-13T16:54:31.040507Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":"2010.02502","doi":"10.48550/arxiv.2010.02502","metadata_source":"pith","pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Denoising Diffusion Implicit Models","venue":"cs.LG","work_id":"8fa2128b-d18c-405c-ac92-0e669cf89ac0","year":2020},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:942ca29abc79782059b8f719466ac36251032bb4bdd63ed216352ac85b3b57d7","observation_id":"a3da8bbf-4ade-40b7-8d08-a6220c04e582","resolution":{"observed_at":"2026-05-13T16:54:31.043025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.05952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:05:55.300508Z","title":"Coefficients-preserving sampling for reinforcement learning with flow matching.arXiv preprint arXiv:2509.05952","venue":null,"work_id":"3bc58f2f-e4be-4ee5-804f-29ffd6dfdb30","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:8fd857315faad0ecee9b273ea6df1b2855f32ad7dc26c1598b05256296a98470","observation_id":"baa0c7fe-655c-47ed-8464-4450d7f27b24","resolution":{"observed_at":"2026-05-13T16:54:30.979686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":"2503.05236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.05236","snapshot_observed_at":"2026-07-04T16:59:58.010213Z","title":"Unified Reward Model for Multimodal Understanding and Generation","venue":"cs.CV","work_id":"bf9fcf9a-1781-4008-960e-2bec1a717e4e","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2503.05236","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:3df187a9a7137f89c0e27efa84d920b373dc515e7b8438cfe2c9e89b8ee8fe5a","observation_id":"d281ccfb-2a55-450b-82ff-588a5c6dcb03","resolution":{"observed_at":"2026-05-14T00:44:31.060111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human preference score: Better aligning text-to-image models with human preference","venue":null,"work_id":"9fb45a66-8383-453b-bcaa-eab1011d564a","year":2096},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:f727659a8f407ebbcaba6393d6ac4c4efc02b830b7bed9adc35bb3850f5f38c5","observation_id":"0e2c99e4-3cf7-4e2b-b9cc-5dfe8da4c49b","resolution":{"observed_at":"2026-05-13T16:54:31.053359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11343","last_updated":"2025-06-12T06:03:24Z","snapshot_observed_at":"2026-07-06T21:09:50.780345Z","submitted_at":"2025-04-15T16:15:02Z","title":"A Minimalist Approach to LLM Reasoning: from Rejection Sampling to Reinforce","version":2},"cited_work":{"arxiv_id":"2504.11343","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11343","snapshot_observed_at":"2026-07-09T04:05:55.456269Z","title":"A minimalist approach to llm reasoning: from rejection sampling to reinforce.arXiv preprint arXiv:2504.11343","venue":"cs.LG","work_id":"90392907-b8b0-4771-9ac8-6cd50245b1dd","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2504.11343","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:b739701ed9a77f78687014c1d4ca65912e64276100e85ea90f422346176b4768","observation_id":"3a903c09-9f27-48b5-996a-8758fa183abe","resolution":{"observed_at":"2026-05-13T16:54:30.986262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-07-31T14:51:03.625964Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":"2505.07818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-07-09T03:05:55.316091Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","venue":"cs.CV","work_id":"7404dd36-8f9c-478f-b089-ef9f8189c711","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:d8ddcc853c8721e09ce85ade440406b195fffc396624c03786811d994dd44d6f","observation_id":"13844d2c-8f9a-48e6-887f-d444a867f0ce","resolution":{"observed_at":"2026-05-13T16:54:30.989230Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13902","last_updated":"2023-02-25T20:30:35Z","snapshot_observed_at":"2026-07-06T13:04:57.055751Z","submitted_at":"2022-04-29T06:32:38Z","title":"Fast Sampling of Diffusion Models with Exponential Integrator","version":4},"cited_work":{"arxiv_id":"2204.13902","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.13902","snapshot_observed_at":"2026-07-04T15:39:57.095359Z","title":"Fast sampling of diffusion models with exponential integrator.arXiv preprint arXiv:2204.13902","venue":null,"work_id":"1ead7a15-4ec3-4add-968c-6cb18b6ff768","year":2022},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2204.13902","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:c5282db845386b656de8f416840da40829bd582d79e113e1e201f5f5286a12f9","observation_id":"a10139b4-1190-4127-9708-6f829f981c1c","resolution":{"observed_at":"2026-05-13T16:54:30.992398Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15885","last_updated":"2025-04-30T08:56:54Z","snapshot_observed_at":"2026-07-06T18:19:33.945119Z","submitted_at":"2024-05-24T19:08:30Z","title":"Diffusion Bridge Implicit Models","version":6},"cited_work":{"arxiv_id":"2405.15885","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.15885","snapshot_observed_at":"2026-06-29T08:53:16.212711Z","title":"Dpm-solver-v3: Improved diffusion ode solver with empirical model statistics","venue":null,"work_id":"91fb56f3-5bbc-4344-a2ff-57596f8f6347","year":2024},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2405.15885","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:902c6a6afa079339e205bb2c855046854e7d49528c4eb2bc1a27d10f3d096a17","observation_id":"67b9a9e0-0d82-4e10-b6b5-b1223c43c230","resolution":{"observed_at":"2026-05-13T16:54:30.995484Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f63edca5-2c10-4fe0-97fe-4047cd2c446f","year":2026},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:bfc2fc1ed2604a6c46b428500f6b5288f7599108ce1e2b5ebbb455d89e8166a0","observation_id":"e58cc864-4d90-4083-b2cb-eea320d7e78f","resolution":{"observed_at":"2026-05-13T16:54:31.055191Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We provide a simpler and more principled perspective based solely on the diffusion model framework","venue":null,"work_id":"ad4e0fac-74d1-426f-86b2-f5c3fd605533","year":2021},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:a757aee0c112413cc61e98406671aa4d87f2df4eba970a22ecea9a77cdf629ad","observation_id":"c9c23f10-0754-4c29-a7d9-8a417337ed60","resolution":{"observed_at":"2026-05-13T16:54:31.047481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"B.3 INTUITION BEHIND THEFLOWGRPO OBJECTIVE We provide some insight into reverse-process diffusion RL by inspecting the FlowGRPO objective in a sampler-agnostic manner","venue":null,"work_id":"9a72ea9d-831a-4616-8d7d-4ead4a4e9ab1","year":2026},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:57568f9b87cb5f0afdb5485804643bc4b0d4500ea7d88fefb86cfb115007aa72","observation_id":"e6292ee4-2bda-475b-86da-9a4f10183611","resolution":{"observed_at":"2026-05-13T16:54:31.049506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Consult Doctor","venue":null,"work_id":"d9c730f8-0645-412b-b407-cd04ffb88297","year":2026},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:7d8d6750eb6af18aecd84adc8357e6f44b9734ee1cc0d3ed9bc5c6c2b7219637","observation_id":"434c7e89-71c2-4940-a5cb-9bda7f179e8e","resolution":{"observed_at":"2026-05-13T16:54:31.051450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":24,"verified_fuzzy":5},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 79 inbound Pith citation observations for arXiv:2509.16117."}