{"as_of":"2026-08-13T20:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:959a2c3e66d934661922f88937e3284a79ba02df42765b0a814ad5f7a05c8ba7","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T23:02:29.120150Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:07:57.812113Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T01:46:41.044701Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":"2605.08063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-07-10T01:46:41.044701Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","venue":"cs.CV","work_id":"36994bd5-ac22-49fb-9a5a-7e9c7105b5df","year":2026},"citing_paper":{"arxiv_id":"2605.25378","last_updated":"2026-05-27T03:52:59Z","snapshot_observed_at":"2026-08-13T07:20:56.688480Z","submitted_at":"2026-05-25T03:07:01Z","title":"CollectionLoRA: Collecting 50 Effects in 1 LoRA via Multi-Teacher On-Policy Distillation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T22:34:34.927202Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2605.25378"},"observation_digest":"sha256:ba1cb51684761d409f71f2d39da2fa736fcfa65451a69924299bc1718e287563","observation_id":"a09e644e-bf7c-4ce7-90c5-a46c4235bad2","resolution":{"observed_at":"2026-06-29T22:44:01.967546Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":"2605.08063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-07-10T01:46:41.044701Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","venue":"cs.CV","work_id":"36994bd5-ac22-49fb-9a5a-7e9c7105b5df","year":2026},"citing_paper":{"arxiv_id":"2606.02684","last_updated":"2026-06-04T15:52:50Z","snapshot_observed_at":"2026-08-05T23:43:40.149646Z","submitted_at":"2026-06-01T17:58:22Z","title":"Filter, Then Reweight: Rethinking Optimization Granularity in On-Policy Distillation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-28T15:14:42.489647Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2606.02684"},"observation_digest":"sha256:e5fbe78fa23b0128b55521be8749a1bdfb429e86b1471feed4751b97622a7a16","observation_id":"ccee52f2-b027-45a1-92ec-1835f22637f1","resolution":{"observed_at":"2026-07-01T22:36:17.405805Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":"2605.08063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-07-10T01:46:41.044701Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","venue":"cs.CV","work_id":"36994bd5-ac22-49fb-9a5a-7e9c7105b5df","year":2026},"citing_paper":{"arxiv_id":"2606.03746","last_updated":"2026-06-03T05:16:34Z","snapshot_observed_at":"2026-08-12T00:53:53.179304Z","submitted_at":"2026-06-02T15:00:22Z","title":"Qwen-Image-Flash: Beyond Objective Design","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T11:00:04.775189Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2606.03746"},"observation_digest":"sha256:791b92486da122a4efa24d1ea73351619dd8a96cdd2d14b61ac6cf579bff6d7e","observation_id":"69bf3f1e-3ab5-4125-a429-c120bed6187f","resolution":{"observed_at":"2026-07-02T02:26:26.209957Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":"2605.08063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-07-10T01:46:41.044701Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","venue":"cs.CV","work_id":"36994bd5-ac22-49fb-9a5a-7e9c7105b5df","year":2026},"citing_paper":{"arxiv_id":"2606.27377","last_updated":"2026-07-07T04:28:57Z","snapshot_observed_at":"2026-08-12T16:23:04.774360Z","submitted_at":"2026-06-25T17:59:58Z","title":"DanceOPD: On-Policy Generative Field Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T04:55:42.018348Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2606.27377"},"observation_digest":"sha256:e60293da164322d9fe4d3a711b53ce17d2ef4652e7e693e9174883cd9ef9c5c2","observation_id":"f2677ecb-d242-4761-95bc-04ed3107395b","resolution":{"observed_at":"2026-07-04T13:49:51.393566Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-07-12T11:44:54.717393Z","title":"Flow-OPD: On-policy distillation for flow matching models.arXiv preprint arXiv:2605.08063, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.27377","last_updated":"2026-07-07T04:28:57Z","snapshot_observed_at":"2026-08-12T16:23:04.774360Z","submitted_at":"2026-06-25T17:59:58Z","title":"DanceOPD: On-Policy Generative Field Distillation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T11:44:54.717393Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2606.27377"},"observation_digest":"sha256:138feeb43d8645ae918a310d05946aaaa04b9ee5a1c1aa589a13244c371b58d9","observation_id":"8130d905-5353-4844-b283-7e5446b546c4","resolution":{"observed_at":"2026-07-12T11:44:54.717393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":"2605.08063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-07-10T01:46:41.044701Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","venue":"cs.CV","work_id":"36994bd5-ac22-49fb-9a5a-7e9c7105b5df","year":2026},"citing_paper":{"arxiv_id":"2606.27608","last_updated":"2026-06-25T23:49:50Z","snapshot_observed_at":"2026-07-07T00:01:49.598947Z","submitted_at":"2026-06-25T23:49:50Z","title":"Qwen-Image-2.0-RL Technical Report","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T01:11:12.757656Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2606.27608"},"observation_digest":"sha256:0e31c73cd74fc67e70de6f6bc0710fb7fb6d570e0263f936f01faa152cafcf1c","observation_id":"401bdcef-e218-46a2-ad41-79edc5695a72","resolution":{"observed_at":"2026-07-01T19:06:02.859413Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":"2605.08063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-07-10T01:46:41.044701Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","venue":"cs.CV","work_id":"36994bd5-ac22-49fb-9a5a-7e9c7105b5df","year":2026},"citing_paper":{"arxiv_id":"2607.08766","last_updated":"2026-07-09T17:59:11Z","snapshot_observed_at":"2026-08-13T19:46:11.199620Z","submitted_at":"2026-07-09T17:59:11Z","title":"OPSD-V: On-Policy Self-Distillation for Post-Training Few-Step Autoregressive Video Generators","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T01:43:20.551939Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2607.08766"},"observation_digest":"sha256:a831a6ed15fa73ff4e7cd50c0cec924ad0faa11f75cb23a0e04ae4543571ce8a","observation_id":"27f1636a-25a4-47f2-b740-2f494e2457cb","resolution":{"observed_at":"2026-07-10T01:46:41.046168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-08-01T21:31:18.478134Z","title":"arXiv:2605.08063","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16060","last_updated":"2026-08-05T13:13:04Z","snapshot_observed_at":"2026-08-08T23:13:03.580809Z","submitted_at":"2026-07-17T15:38:33Z","title":"ArtChart: Faithful Artistic Chart Generation with Integrated Text Rendering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T21:31:18.478134Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2607.16060"},"observation_digest":"sha256:2b9f304bc1226fe89067991fbd0ca514ffba1ed82a30d843a8d525bf3077ecd0","observation_id":"6f989ac4-0cf3-4317-815b-03b5eedb3f60","resolution":{"observed_at":"2026-08-01T21:31:18.478134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-07-31T12:31:28.249661Z","title":"Flow-opd: On-policy distillation for flow matching models.arXiv preprint arXiv:2605.08063,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24522","last_updated":"2026-07-27T15:03:22Z","snapshot_observed_at":"2026-08-06T15:46:02.023742Z","submitted_at":"2026-07-27T15:03:22Z","title":"FlowCTS: On-policy Continuous Trajectory Supervision of Flow Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-31T12:31:28.249661Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2607.24522"},"observation_digest":"sha256:c6621e3253544a7631ab2eb1bde6d3c98be4ba2b59c71b59077aa3d3406ba962","observation_id":"5190c60f-9532-4e49-ba57-d44ea1828e54","resolution":{"observed_at":"2026-07-31T12:31:28.249661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-07-31T06:35:52.550309Z","title":"Flow-opd: On-policy distillation for flow matching models.arXiv preprint arXiv:2605.08063,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24731","last_updated":"2026-07-30T05:33:15Z","snapshot_observed_at":"2026-08-10T04:39:06.439560Z","submitted_at":"2026-07-27T17:57:02Z","title":"Rethinking Classifier-Free Guidance in On-Policy Diffusion Distillation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T06:35:52.550309Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2607.24731"},"observation_digest":"sha256:4a2158263ec70685da652bbf04c244a644511f6148192dfdc9ccf13333aa0afa","observation_id":"ed9b9051-2f5c-4494-b155-3ad0a7b6404e","resolution":{"observed_at":"2026-07-31T06:35:52.550309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-08-03T15:29:59.022263Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-08T06:41:11.996778Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:59.022263Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:f1cedb3b1881b58901d647491c50370b626ea4a50fd97102db5c3968f669f276","observation_id":"73401ac0-0666-49b5-b1d4-e6e2d1aad336","resolution":{"observed_at":"2026-08-03T15:29:59.022263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-08-05T21:17:16.066972Z","title":"arXiv preprint arXiv:2605.08063 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03316","last_updated":"2026-08-04T08:23:57Z","snapshot_observed_at":"2026-08-13T19:03:22.455294Z","submitted_at":"2026-08-04T08:23:57Z","title":"Any-OPD: Heterogeneous On-Policy Distillation for Flow-Matching Models via Representation-Space Bridging","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T21:17:16.066972Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2608.03316"},"observation_digest":"sha256:dd15084faafbcf5bf2b3530323bbb88430848db5eee585dd9af4c40e8c7cf8cc","observation_id":"e0e57160-ff4b-4e58-bcc5-34741327364e","resolution":{"observed_at":"2026-08-05T21:17:16.066972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-08-08T19:19:14.648725Z","title":"arXiv preprint arXiv:2605.08063 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04349","last_updated":"2026-08-05T01:48:55Z","snapshot_observed_at":"2026-08-13T13:50:29.085991Z","submitted_at":"2026-08-05T01:48:55Z","title":"Poly-OPD: Heterogeneous Multi-Teacher On-Policy Distillation for Capability-Selectable Flow Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T19:19:14.648725Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2608.04349"},"observation_digest":"sha256:1afaed6e4dcaf8c5a403dac327ff20a15c0c138c60e3b632d807979ae90fb63c","observation_id":"ac816fb4-6eaa-44d9-863f-207f2f20cc16","resolution":{"observed_at":"2026-08-08T19:19:14.648725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-08-11T21:07:57.812113Z","title":"Flow-opd: On-policy distillation for flow matching models.arXiv preprint arXiv:2605.08063,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09233","last_updated":"2026-08-10T07:55:57Z","snapshot_observed_at":"2026-08-13T20:26:28.814758Z","submitted_at":"2026-08-10T07:55:57Z","title":"DreOPD: Degraded-Reference Extrapolative On-Policy Distillation for Flow-matching Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T21:07:57.812113Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2608.09233"},"observation_digest":"sha256:f7c585cc7c6bace9cbdb4aca8d4470baa60dfd3d2eac32a573862273ee3ae566","observation_id":"a3312d3c-18f1-4985-b7f4-74cc0859b3b2","resolution":{"observed_at":"2026-08-11T21:07:57.812113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.08063/citation-record","integrity":"/paper/2605.08063/integrity","json":"/paper/2605.08063/citation-record.json","paper":"/paper/2605.08063"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.210506Z","title":null,"venue":null,"work_id":"d727b80f-2e5d-42f3-87e1-45e3a176d42d","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:c309fab28bcf78678199a25b698df3331bc8b469ef8ecf84c56ba25df740c68e","observation_id":"a91f76a8-7138-4aac-9305-ec5515619589","resolution":{"observed_at":"2026-07-07T12:13:45.211518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:24:54.779001Z","title":"Scaling rectified flow trans- formers for high-resolution image synthesis","venue":null,"work_id":"3561a0ff-7939-4f07-9620-be9f8868052e","year":2024},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:316ab919c8ba88fef886d69b07036280cfff4403e1e632bac2499a168aaca4a6","observation_id":"66c7a2f1-3086-4a6c-b28f-c6f871bc9238","resolution":{"observed_at":"2026-07-07T12:13:45.221791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:34a504e06a2ff8ed39e56a2123afa3123180ca8586fcb60f4a8af97c7abaebfe","observation_id":"3e71ed6e-58b6-4d5f-b310-7594f191da4d","resolution":{"observed_at":"2026-06-30T23:05:07.261733Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.22134","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T09:55:41.032717Z","title":"Dualvla: Building a generalizable embodied agent via partial decoupling of reasoning and action","venue":null,"work_id":"6de2846d-228a-4430-88af-85c55d24c168","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:5cfd22a471ab078065a70940691e7d322dd9ad634fe3cb17e470293c155c97f9","observation_id":"7e74ce14-25f4-4805-af19-8f856fe233f4","resolution":{"observed_at":"2026-06-30T23:05:07.244718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.237176Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models, 2026","venue":null,"work_id":"f555e930-8524-437f-b595-7bd1ae8f1f61","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:e83ac9e097c6d2722bea242f7c4aff22a2326cd1d85bd62c2c2c673b319499ba","observation_id":"80f96572-4688-4b3b-b18e-a3ec2637fa80","resolution":{"observed_at":"2026-07-07T12:13:45.238354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.22060","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T07:26:54.466920Z","title":"Vision-deepresearch: Incentivizing deepresearch capability in multimodal large language models","venue":null,"work_id":"c19e1b2b-ef3b-4af7-b0ee-6aae3c27fd7a","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:8843284308a15d6fc983d7ef9a8649fd970840b68ba58dcafd75fd4ad42f9031","observation_id":"5b39bc5b-4c0d-4f9a-9972-b60439e1d75f","resolution":{"observed_at":"2026-06-30T23:05:07.248068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.04207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:39:46.108094Z","title":"Advancing multimodal reasoning: From optimized cold start to staged reinforcement learning","venue":null,"work_id":"e1d43ddb-94f1-408f-91dd-f345ae9f4d87","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:cbf51f02773a4f5e01a36614cf08621b839a227aba3717d0946f1d55efd243ba","observation_id":"af800b1c-799f-4a9a-9783-5cd7b12ea13d","resolution":{"observed_at":"2026-06-30T23:05:07.254996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.08457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T05:16:48.115469Z","title":"Ares: Multimodal adaptive reasoning via difficulty-aware token-level entropy shaping","venue":null,"work_id":"86e3cc2e-b03c-4c04-98cb-55c976629bbc","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:b1555def5988b858c4992995ef171358ce4a824662aa7ee51f8e5bfbe0397fe2","observation_id":"3cdaef82-b274-4188-9dea-cc5ae5079c52","resolution":{"observed_at":"2026-06-30T23:05:07.258793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.238856Z","title":"Opensearch-vl: An open recipe for frontier multimodal search agents","venue":null,"work_id":"81f7e996-f57a-4c3c-aff8-ff3cba171101","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:b5ea2435b6611879f097bf239e3e63e6e5e375a5a12bc774316295a7755f4f28","observation_id":"95786e95-88eb-428c-9837-f392268102da","resolution":{"observed_at":"2026-07-07T12:13:45.240285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.03193","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:39:51.536686Z","title":"Unicorn: Towards self-improving unified multimodal models through self- generated supervision.arXiv preprint arXiv:2601.03193","venue":null,"work_id":"b9ffd395-f28d-4fdb-87e4-ea7234f16ed1","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:0aa5434bae870d60b79e9974f929aaf96df156606264f834027cb67092fd7e21","observation_id":"e695a49a-c9d8-43dc-8996-8c72a65d9889","resolution":{"observed_at":"2026-06-30T23:05:07.254845Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.29620","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:19:47.340280Z","title":"Unify-agent: A unified multimodal agent for world-grounded image synthesis","venue":null,"work_id":"570f17f3-a203-44c4-a42f-b29552d940a5","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:7bf8467d28a85e8331584723744dba1ab24f7bfb6b67b87aa3dfb38f274653e6","observation_id":"d965bc1b-f804-4eae-b68a-cb232c911256","resolution":{"observed_at":"2026-06-30T23:05:07.267827Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.28767","last_updated":"2026-05-22T17:26:49Z","snapshot_observed_at":"2026-07-06T22:51:09.377351Z","submitted_at":"2026-03-30T17:59:56Z","title":"Gen-Searcher: Reinforcing Agentic Search for Image Generation","version":3},"cited_work":{"arxiv_id":"2603.28767","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.28767","snapshot_observed_at":"2026-07-04T14:59:55.924942Z","title":"Gen-Searcher: Reinforcing Agentic Search for Image Generation","venue":"cs.CV","work_id":"95bc1d11-f794-40b4-9c28-d0aff2dbea12","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2603.28767","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:d8d6d88c7f22a3e30c84caaa7b8f391fc1958cf40a9da628051d5d8e732ac776","observation_id":"223cb247-875e-4f20-b40f-2f0d67f28678","resolution":{"observed_at":"2026-06-30T23:05:07.274031Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06945","last_updated":"2025-09-09T10:50:30Z","snapshot_observed_at":"2026-08-12T19:13:52.636156Z","submitted_at":"2025-09-08T17:56:23Z","title":"Interleaving Reasoning for Better Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2509.06945","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06945","snapshot_observed_at":"2026-07-04T16:39:58.253188Z","title":"Interleaving reasoning for better text-to-image generation","venue":null,"work_id":"d8284b77-8931-4f0c-bf78-042627e2d030","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2509.06945","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:66efad2c0142324b75814f4fdf846c8e6417acc8c30259ef27e40116588e801d","observation_id":"b10ec737-893f-4828-8850-e260f3b6d7e4","resolution":{"observed_at":"2026-06-30T23:05:07.211199Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:c0a2fc02f2096a6418f237a216988cb95d63b4a53b22f887e48dd1bf569f3f5d","observation_id":"64d914c7-fd2a-4158-b40f-67e3dff47bc3","resolution":{"observed_at":"2026-06-30T23:05:07.211077Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.240939Z","title":"Dancegrpo: Unleashing grpo on visual generation","venue":null,"work_id":"3102936d-1346-498a-a3fa-1f25b032d704","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:11368e0ac856e253950c883f7a64f16a58c321c94226d9ca01260bbf8e4f5364","observation_id":"a2167dc0-d770-49ea-8253-1c8396fb4168","resolution":{"observed_at":"2026-07-07T12:13:45.242642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21802","last_updated":"2026-03-20T17:20:12Z","snapshot_observed_at":"2026-08-01T16:12:11.335962Z","submitted_at":"2025-07-29T13:40:09Z","title":"MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE","version":6},"cited_work":{"arxiv_id":"2507.21802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.21802","snapshot_observed_at":"2026-07-09T03:05:55.323624Z","title":"MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE","venue":"cs.AI","work_id":"8b0ab84a-b7ea-46ea-a6ba-bf490a84d251","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2507.21802","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:2be5e899454770d39cb6ebe9fdefe96cbd8d353c88d572be6dfb77e7b76b84dc","observation_id":"468b2dac-b30a-4bec-88eb-4ca16c29c1ce","resolution":{"observed_at":"2026-06-30T23:05:07.197061Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":"2602.15763","doi":"10.48550/arxiv.2602.15763","metadata_source":"pith","pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","venue":"cs.LG","work_id":"ad29b1a2-bf77-46b3-9ead-fb62b1d2c6fe","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:8517241107dd96df6f3be841d35e3bb881c85d7fda1db0d9a5740f1f8513b3c8","observation_id":"25c36539-8dde-4ffd-8247-c4f821d377c0","resolution":{"observed_at":"2026-06-30T23:05:07.200138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-08-13T08:59:50.823205Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"cited_work":{"arxiv_id":"2601.02780","doi":"10.48550/arxiv.2601.02780","metadata_source":"pith","pith_arxiv_id":"2601.02780","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MiMo-V2-Flash Technical Report","venue":"cs.CL","work_id":"1f3df90c-4bc3-49b1-ad9b-7f3b34e4ffba","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2601.02780","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:bd538e241e340da371c8cb273266dfd78f210fbf121b806ee91b5d5fb554b839","observation_id":"28b8d2d3-d86d-46ef-afce-4ca37d5e2b53","resolution":{"observed_at":"2026-06-30T23:05:07.213902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:38:12.703557+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:38:12.703557+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.243589Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment.Advances in Neural Information Processing Systems, 36:52132–52152, 2023","venue":null,"work_id":"6c471ad2-4df5-48ef-b56a-9df5828cf33e","year":2023},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:2f5d30c438b24b313c4eb32131587b782978bac3a507e22b64600d3251cf0156","observation_id":"c9e74e51-06bb-4a2c-963e-72f57034596e","resolution":{"observed_at":"2026-07-07T12:13:45.245210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.233244Z","title":"Textdiffuser: Diffusion models as text painters.Advances in Neural Information Processing Systems, 36:9353– 9387","venue":null,"work_id":"496da14d-c548-4a42-9bfc-547df0e34e7c","year":2023},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:49b4dfe147da2b98e66bfc58c3ac5f7159e2876c4a823b428cb210f51f60fe4d","observation_id":"bae81ae3-fee2-4eed-a012-325e13db8cf3","resolution":{"observed_at":"2026-07-07T12:13:45.234639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.229453Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":"3030b123-51c9-4334-afc3-25ed395d0452","year":2024},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:a911094321235e5265acc7df2deabc56da5db2ee6e84e4eda5238a8af45e0bdc","observation_id":"e1ba4e03-c8ae-4d4f-aeff-73899311fb3e","resolution":{"observed_at":"2026-07-07T12:13:45.230681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.231491Z","title":"Dpok: Reinforcement learning for fine-tuning text-to-image diffusion models","venue":null,"work_id":"316591ab-e944-4e9b-a6cb-2e57291a4f23","year":2023},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:0df1ebc8fba9cb0589603c307a920ea833353b2f48a42ba7e3620e44d43f1b29","observation_id":"96263acc-8ac5-4ff7-8a8e-d202f0ed1092","resolution":{"observed_at":"2026-07-07T12:13:45.232686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.235469Z","title":"Imagereward: learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"4e0774e0-3101-4e5b-a0b1-324be5dd8fe7","year":2023},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:b48eae59ff00bf9c1b18d4b8083245d40e8c799045d2c306fd0aced73f19334d","observation_id":"59e43cfe-be79-4194-acc0-705e20427db8","resolution":{"observed_at":"2026-07-07T12:13:45.236645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.248784Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":"0b297904-18b2-4679-85d9-c59ac060f7e4","year":2023},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:0000544f8ef8b4a3f7da1d880f4e542262d460b754f5c32cd9f8da68f3f75e55","observation_id":"c11f2208-c858-46c8-9459-dcc829dd2341","resolution":{"observed_at":"2026-07-07T12:13:45.249882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-13T10:15:00.293616Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":"2505.05470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-07-09T02:25:55.898592Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","venue":"cs.CV","work_id":"bf1e8e81-ff31-401a-a5dc-d9c49df168ab","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:a47efab13c5bf87f8d6fb90b22124458f5ee4e7a38cceb817db51309b54d3ce3","observation_id":"e94abee9-1bae-46ed-9689-99c9a237dff2","resolution":{"observed_at":"2026-06-30T23:05:07.223673Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06924","last_updated":"2025-08-09T10:37:26Z","snapshot_observed_at":"2026-08-05T22:28:00.444639Z","submitted_at":"2025-08-09T10:37:26Z","title":"AR-GRPO: Training Autoregressive Image Generation Models via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2508.06924","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.06924","snapshot_observed_at":"2026-06-30T23:05:07.202113Z","title":"Ar-grpo: Training autoregressive image generation models via reinforcement learning","venue":null,"work_id":"4f82a259-3e7b-4a7c-ad13-0bcd78e9ed25","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2508.06924","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:e3e57ac9e1922315f9fac8492cbc08d0cb416fc90b3fd41ea7cfddc760e7cc5c","observation_id":"38b76edc-9ccf-412d-9a0c-fee4be8d2d46","resolution":{"observed_at":"2026-06-30T23:05:07.203930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.22485","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:49:36.969379Z","title":"Group critical-token policy optimization for autoregressive image generation","venue":null,"work_id":"8fd75315-aefb-4fca-981b-782773f19301","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:32c998b184faecfd116c615a923afe2f49a63b442a4fa793978c8f1f09ec8cf3","observation_id":"03c190be-ce76-4ecd-9326-cd2181605489","resolution":{"observed_at":"2026-06-30T23:05:07.227667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25027","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T14:35:47.149396Z","title":"Stage: Stable and generalizable grpo for autoregressive image generation","venue":null,"work_id":"2aecdf97-58d9-447f-b789-118d17186d64","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:c280afdf892155ea89e6847ca7af32fe7cfc2a5b88d178ca5c4e5edb25199c68","observation_id":"97e58cbd-d4a3-4ee2-9527-598b6f391037","resolution":{"observed_at":"2026-06-30T23:05:07.264939Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.18766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T23:05:07.235657Z","title":"Maskfocus: Focusing policy optimization on critical steps for masked image generation","venue":null,"work_id":"6f12a77e-b9a2-47df-b9cf-8d2de8ae804a","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:60db41418970e2276e4f7b9788be14824204cc60b09f84451ac8ca935ba5085c","observation_id":"725afb2d-2343-40b9-90fc-6550de42cc0f","resolution":{"observed_at":"2026-06-30T23:05:07.237873Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06966","last_updated":"2026-04-08T11:30:35Z","snapshot_observed_at":"2026-08-11T08:53:53.480489Z","submitted_at":"2026-04-08T11:30:35Z","title":"MAR-GRPO: Stabilized GRPO for AR-diffusion Hybrid Image Generation","version":1},"cited_work":{"arxiv_id":"2604.06966","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.06966","snapshot_observed_at":"2026-06-30T23:05:07.239492Z","title":"MAR-GRPO: Stabilized GRPO for AR-diffusion Hybrid Image Generation","venue":"cs.CV","work_id":"372415ff-988d-4a3a-b884-a133e57c16b9","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2604.06966","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:94b7902086cba273fd4c093aa7909410e578ca7d9bb54441e3e849fb088e3fa6","observation_id":"65ff4660-1838-4c73-89d9-21fa16621882","resolution":{"observed_at":"2026-06-30T23:05:07.241028Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.223196Z","title":"Gdpo: Group reward-decoupled normalization policy optimization for multi-reward rl optimization","venue":null,"work_id":"da3282da-fc6d-4544-ad43-6b19cde16f56","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:e3841f2384b77366bb462a6a544e03cf7ad9ff4d24cbe9a9d924a464f5380ddc","observation_id":"585f42be-5381-4eda-b776-751c12e0a821","resolution":{"observed_at":"2026-07-07T12:13:45.224967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:14:30.522565Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":"3733ff2d-cd95-4776-9fa9-1b2328326749","year":2024},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:740b7bb259d2af5158f764297d90c8a49609e1aa0f057b356f421b128508c314","observation_id":"501ac910-cfe6-41bc-b648-abbcaa451632","resolution":{"observed_at":"2026-07-07T12:13:45.226872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:14:30.575750Z","title":"Minillm: Knowledge distillation of large language models","venue":null,"work_id":"b1e6b0f6-8514-45e3-8ada-200c47bc849c","year":2024},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:c84620276dce374d569ad4fbb9e53108d8a874953f921f1b3a1ff276cf70a91e","observation_id":"8a38b412-4c97-48a0-8d14-1f5fff80410d","resolution":{"observed_at":"2026-07-07T12:13:45.228845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07067","last_updated":"2025-05-30T04:41:12Z","snapshot_observed_at":"2026-08-08T09:26:03.922623Z","submitted_at":"2025-03-10T08:51:32Z","title":"DistiLLM-2: A Contrastive Approach Boosts the Distillation of LLMs","version":2},"cited_work":{"arxiv_id":"2503.07067","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.07067","snapshot_observed_at":"2026-07-10T10:37:01.562752Z","title":"Distillm-2: A contrastive approach boosts the distillation of llms","venue":"cs.CL","work_id":"ade2b501-2ca3-4825-9150-d23205f4edb9","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2503.07067","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:675e5caa66be3feb0b8b2798d64a4562a90cb3c8e1cf615985f6aa1ddac3608f","observation_id":"2129fdcb-5d2b-4d3e-beb8-6ec1ef47e87d","resolution":{"observed_at":"2026-06-30T23:05:07.251601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12125","last_updated":"2026-02-26T13:26:22Z","snapshot_observed_at":"2026-08-12T23:31:10.409888Z","submitted_at":"2026-02-12T16:14:29Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","version":2},"cited_work":{"arxiv_id":"2602.12125","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12125","snapshot_observed_at":"2026-07-09T00:35:48.740330Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","venue":"cs.LG","work_id":"bb968107-1f43-4bf4-aa52-cc58000a6e89","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2602.12125","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:68b111663a7d6a4352d4bdcd37ec5e15d65ddfa8ec20ef364ecf90c3a76dd3c5","observation_id":"4c5bf3cd-567f-4a87-b520-d44d060aa831","resolution":{"observed_at":"2026-06-30T23:05:07.268007Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.07079","last_updated":"2026-05-22T17:34:18Z","snapshot_observed_at":"2026-08-12T21:43:11.603622Z","submitted_at":"2026-03-07T07:26:18Z","title":"Entropy-Aware On-Policy Distillation of Language Models","version":2},"cited_work":{"arxiv_id":"2603.07079","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.07079","snapshot_observed_at":"2026-07-09T21:06:34.837233Z","title":"Entropy-aware on-policy distillation of language models","venue":"cs.LG","work_id":"7dccbe12-e2aa-48d8-9b76-5521ccf02668","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2603.07079","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:1f5a0af25a5149ccccfbeb4a6175f844d8ccbcc0a2063eb8e3199f966753305e","observation_id":"dc6281a4-cc26-42fe-bfe0-955cc9cad4c9","resolution":{"observed_at":"2026-06-30T23:05:07.271025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.15260","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:33:45.224297Z","title":"Fast and effective on-policy distillation from reasoning prefixes","venue":null,"work_id":"6324480f-043f-4aef-84e8-9e334f9dac7a","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:01aa687145b3081e6f46a1843c777d0733912e824229a844e5891c86e510b9dc","observation_id":"f1cda52c-a659-483d-a512-21696893ed63","resolution":{"observed_at":"2026-06-30T23:05:07.214348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.216142Z","title":"Paced: Distillation and self-distillation at the frontier of student competence.arXiv e-prints, pages arXiv–2603","venue":null,"work_id":"33b70eaf-f4d1-4d64-853b-c5e7dfc37c51","year":2026},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:b83f4042a77f8ad753ff60748e8f71f7d0dd195d4e0bffe5b65d9f82daeb233e","observation_id":"f8912e26-cb7a-4788-8e23-19b0577f1fda","resolution":{"observed_at":"2026-07-07T12:13:45.217283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:55.027208Z","title":"On-policy distillation.Thinking Machines Lab: Connec- tionism","venue":null,"work_id":"a8ef1c05-c183-44e0-bb9e-3b084838e43c","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:aad32f01622cdd3b538a037e3a13f78fdb5d8d1fd8d081eb95c206fc75db535d","observation_id":"d54ea958-c430-45ba-a40c-2accf4f68eef","resolution":{"observed_at":"2026-07-07T12:13:45.213144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.214254Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation.Advances in Neural Information Processing Systems, 36:36652–36663","venue":null,"work_id":"1892be31-f322-42fc-aa2f-4b7993f4a92a","year":2023},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:b003b99885690389d37bae3f6fcda5487e7175c679cc50cb826fd26a3a2c0918","observation_id":"b9994932-da38-404c-8a26-3101cc22c0ed","resolution":{"observed_at":"2026-07-07T12:13:45.215525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.11561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:07:27.912433Z","title":"Teaching large language models to regress accurate image quality scores using score distribution","venue":null,"work_id":"90c61947-bc3f-4b01-9d6b-3b3988c1171e","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:00ff17da2bd868eba532379f26553d65243b994069dfcf95ab3b8cb45b8be195","observation_id":"679ee06e-50be-4d76-926b-1e1d53757416","resolution":{"observed_at":"2026-06-30T23:05:07.230811Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.217994Z","title":"Laion aesthetics, Aug 2022","venue":null,"work_id":"6aeea4d2-83fc-42c4-9582-16138b989610","year":2022},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:b9f5a17094e9b79264864bd8daa6916042e3c4d7f3b817421090f47f90517250","observation_id":"ce1a0940-8075-4cd6-9905-3b990f13fd29","resolution":{"observed_at":"2026-07-07T12:13:45.219746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.245815Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"a1c83aa5-32b0-4a53-8a82-4872494d5d07","year":2024},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:62ade1740b95add5fd9b3a3c6d519186b6cbea886e778eed10393e531c379510","observation_id":"3532654c-53c8-4187-8034-6511fbcdcd02","resolution":{"observed_at":"2026-07-07T12:13:45.248229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":"2503.05236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.05236","snapshot_observed_at":"2026-07-04T16:59:58.010213Z","title":"Unified Reward Model for Multimodal Understanding and Generation","venue":"cs.CV","work_id":"bf9fcf9a-1781-4008-960e-2bec1a717e4e","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2503.05236","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:84566d95167e1388a8caa318c879af043d2a0c23a6b9c4c2853a2076f777303f","observation_id":"9aa0d2ce-382c-49d1-ae50-5004a21c1aea","resolution":{"observed_at":"2026-06-30T23:05:07.223994Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-13T09:05:45.892435Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2306.09341","doi":"10.48550/arxiv.2306.09341","metadata_source":"pith","pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","venue":"cs.CV","work_id":"40702548-f094-4c67-a5db-a62f426f852e","year":2023},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:ad9d7ff8c2a7f21cc99f82cfe441bf9416a58dd663ce771406810c788bbc1a08","observation_id":"52d1b973-000e-4bea-9a2d-09b0dfaea736","resolution":{"observed_at":"2026-06-30T23:05:07.221489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:3e3f3e078eace4a49c1d0a81551eb5b337b5f9cab3c5bf0b16d94fa93d01f919","observation_id":"d8c02852-2b42-433a-8035-76c56d02c6ee","resolution":{"observed_at":"2026-06-30T23:05:07.198163Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:555a1547804143faaedc57e885432a4ff6f144c61af8d4e154d375bd5b0b789e","observation_id":"e8693666-5934-4d0a-bca5-8b80b71f7a5f","resolution":{"observed_at":"2026-06-30T23:05:07.200888Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.206477Z","title":"•3 (Fair):In focus, adequate lighting, but lacks creativity","venue":null,"work_id":"5842e9b1-82ff-4e2e-9bf2-fea4842ae71e","year":null},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:31c75cc41caef3032c6d90303d1bf5cd444ac2b7fc8aa5bed46ea436dc1637bc","observation_id":"8c6828f1-5ae7-40db-914f-86735c46499a","resolution":{"observed_at":"2026-07-07T12:13:45.207824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.208473Z","title":"•3 (Fair):Partially follows, but distorts some important elements","venue":null,"work_id":"c44085cd-f2d7-4158-a042-f8e1ac287842","year":null},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:20a84f1aecd44e196d8bec04360bfae98e77a6bbcb6b1744a2b1842987e19603","observation_id":"263bc3a4-643f-487c-9e20-8f88ed910b96","resolution":{"observed_at":"2026-07-07T12:13:45.209997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:45.204826Z","title":"winner-takes- all","venue":null,"work_id":"dc2d1a1f-6682-4964-95f9-864a157a19be","year":2024},"citing_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-30T23:02:29.120150Z"},"links":{"citing_paper":"/paper/2605.08063"},"observation_digest":"sha256:1939ed2f30f4beee95f49fb8afb21a9abc40cf536d5b8c79fdbe80b8999e0f29","observation_id":"b79f2a78-7c2a-4051-a450-f4c160214d1f","resolution":{"observed_at":"2026-07-07T12:13:45.205987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","latest_version":5,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":28,"verified_fuzzy":21},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 14 inbound Pith citation observations for arXiv:2605.08063."}