{"as_of":"2026-08-12T12:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:382b719f2f6baeb50a777a542324e02217c42af37ceabe1b86dfb486eec3b564","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:17:26.218371Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09226/citation-record","integrity":"/paper/2608.09226/integrity","json":"/paper/2608.09226/citation-record.json","paper":"/paper/2608.09226"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.10759","last_updated":"2026-05-17T07:26:07Z","snapshot_observed_at":"2026-08-08T10:31:32.748819Z","submitted_at":"2026-05-11T15:56:29Z","title":"Reinforce Adjoint Matching: Scaling RL Post-Training of Diffusion and Flow-Matching Models","version":2},"cited_work":{"arxiv_id":"2605.10759","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10759","snapshot_observed_at":"2026-08-11T21:17:28.082208Z","title":"Reinforce Adjoint Matching: Scaling RL Post-Training of Diffusion and Flow-Matching Models","venue":"cs.LG","work_id":"1a3d5129-d42b-453c-a7dd-64608ebf7a27","year":2026},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:25.884274Z"},"links":{"cited_paper":"/paper/2605.10759","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:7a1d2ca2be372ac3e74689bfc0245c5731e33326cec8601824b51d5746d46755","observation_id":"b6ef6fb9-7cad-456b-ab7e-3c58bc6b4177","resolution":{"observed_at":"2026-08-11T21:17:28.103221Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:17:25.922513Z","title":"Directly fine-tuning diffusion models on differentiable rewards","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:25.922513Z"},"links":{"citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:6b094eb4843c517e964e8791d13106c803eea978111e9b98cee7f72a0e0d5df5","observation_id":"d7066390-cbaf-47dd-86c0-ced4649d5272","resolution":{"observed_at":"2026-08-11T21:17:25.922513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13649","last_updated":"2026-07-03T19:09:38Z","snapshot_observed_at":"2026-08-06T17:42:18.711494Z","submitted_at":"2025-11-17T17:59:54Z","title":"Distribution Matching Distillation Meets Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.13649","snapshot_observed_at":"2026-08-11T21:17:25.986375Z","title":"Distribution matching distillation meets reinforcement learning.arXiv preprint arXiv:2511.13649,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:25.986375Z"},"links":{"cited_paper":"/paper/2511.13649","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:b87932c32ce4a54b186fc8471c9736ac669941d35ad5a618f93e400656e496ac","observation_id":"473df447-f9ed-4b85-bac9-148502b865f4","resolution":{"observed_at":"2026-08-11T21:17:25.986375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-06T15:42:21.967989Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-11T21:17:26.006383Z","title":"Offline reinforcement learning with implicit q- learning.arXiv preprint arXiv:2110.06169,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.006383Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:4177c66d86d823bba15df01bc0b00954b27e7892c05b6d8ef5e9fc8677a4a819","observation_id":"2cf23804-0409-40a2-a7ac-130234d1aedd","resolution":{"observed_at":"2026-08-11T21:17:26.006383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-11T21:17:26.064758Z","title":"Flow matching for generative modeling.arXiv preprint arXiv:2210.02747,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.064758Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:5ee43dd43f647f0c4ac3a947112aa319ba5aa5d42fbbb986ffe37cef99581050","observation_id":"726c62d7-b23a-43ee-a52a-c9ca6d1d4cd1","resolution":{"observed_at":"2026-08-11T21:17:26.064758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-11T19:26:36.911580Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-08-11T21:17:26.093900Z","title":"Flow-grpo: Training flow matching models via online rl.arXiv preprint arXiv:2505.05470,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.093900Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:3c38a4e71949276ec839c11eaeb9c8243febffd25460fcaa382d87393d6f495e","observation_id":"bb059e99-97e5-4fd3-8d70-a2b1e5072936","resolution":{"observed_at":"2026-08-11T21:17:26.093900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-11T21:17:26.123274Z","title":"Latent consistency models: Synthe- sizing high-resolution images with few-step inference.arXiv preprint arXiv:2310.04378,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.123274Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:f35c540472ba426a7c2e59435a22bf417fcb1fa0338bec285078f634d9867aee","observation_id":"58454eb9-a254-4c74-9123-1530b1d4479a","resolution":{"observed_at":"2026-08-11T21:17:26.123274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-11T21:17:26.140360Z","title":"Advantage-weighted regression: Simple and scalable off-policy reinforcement learning.arXiv preprint arXiv:1910.00177,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.140360Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:a72a5713636a0b67610fe07577e3a43ffd6cc7e22abdb9b5fa38599eccf2c07a","observation_id":"8f9b5254-5703-4054-93e1-300d8d3225a6","resolution":{"observed_at":"2026-08-11T21:17:26.140360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00512","last_updated":"2022-06-07T09:17:35Z","snapshot_observed_at":"2026-08-12T01:14:44.484432Z","submitted_at":"2022-02-01T16:07:25Z","title":"Progressive Distillation for Fast Sampling of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00512","snapshot_observed_at":"2026-08-11T21:17:26.153697Z","title":"Progressive distillation for fast sampling of diffusion models.arXiv preprint arXiv:2202.00512,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.153697Z"},"links":{"cited_paper":"/paper/2202.00512","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:9b3bfbaa768181c74811e750a864890a14c0cbca4e1e5ccd6c890c2178b5dc06","observation_id":"12332ecc-eda5-460c-91b0-0c5567f77b29","resolution":{"observed_at":"2026-08-11T21:17:26.153697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-11T21:17:26.163274Z","title":"Laion-400m: Open dataset of clip-filtered 400 million image-text pairs.arXiv:2111.02114,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.163274Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:0a101c238224056d4c43097460648f3691f95f8510a5e60bfa7412116ba3d601","observation_id":"dcac9a15-986f-4b5b-aa93-474bfd6e79f6","resolution":{"observed_at":"2026-08-11T21:17:26.163274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-11T21:17:26.177481Z","title":"Deepseekmath: Pushing the limits of mathemati- cal reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.177481Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:e3e6f8db8f4d316f8c9a181acea19ec4a13155511e2d33c11d0a1d5ab82ca704","observation_id":"7019b0b7-0339-470b-b30c-56e65343f8e4","resolution":{"observed_at":"2026-08-11T21:17:26.177481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-11T21:17:26.187733Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.187733Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:aaafeccc2b6afc17ed2f25f2f3a7c9059bbb4e12138dfc863cc064120c702208","observation_id":"22624f64-5525-4fb1-bba9-625fa3e55efe","resolution":{"observed_at":"2026-08-11T21:17:26.187733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-11T00:30:13.593181Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-11T21:17:26.194183Z","title":"Human preference score v2: A solid benchmark for evaluating human preferences of text-to- image synthesis.arXiv preprint arXiv:2306.09341,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.194183Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:98a4fc840833c8b50a0d15d3eb4dd712a2c4c43ac1da815cdfb4da51d2fe5f9c","observation_id":"7ba2f7f8-2b04-4470-8eed-cb7efd88b471","resolution":{"observed_at":"2026-08-11T21:17:26.194183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:17:26.211239Z","title":"Advantage weighted matching: Aligning rl with pretraining in diffusion models.arXiv preprint arXiv:2509.25050, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.211239Z"},"links":{"citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:fa8e87ac678f25186a78eae9df045aafe22c2b4db9a3868c4033629b1624e8cb","observation_id":"feeea68e-5c33-4454-a6b1-4ba886e1b374","resolution":{"observed_at":"2026-08-11T21:17:26.211239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-11T21:17:26.218371Z","title":"Diffusionnft: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.218371Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:c517015a8e8c33befa0f03b47e74c903c6832b124e18018d81ab200d4245ec3a","observation_id":"699355d9-77ee-4507-aec4-0762aac548ec","resolution":{"observed_at":"2026-08-11T21:17:26.218371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21802","last_updated":"2026-03-20T17:20:12Z","snapshot_observed_at":"2026-08-01T16:12:11.335962Z","submitted_at":"2025-07-29T13:40:09Z","title":"MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21802","snapshot_observed_at":"2026-08-11T21:17:26.024780Z","title":"Mixgrpo: Unlocking flow-based grpo efficiency with mixed ode-sde.arXiv preprint arXiv:2507.21802,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.024780Z"},"links":{"cited_paper":"/paper/2507.21802","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:5e52b65d389e60f373886fbbb867298fd60f6ca5466c1f4a5e7269a43e69732c","observation_id":"5ec2ee1a-cdde-476c-bd51-62f397d79f91","resolution":{"observed_at":"2026-08-11T21:17:26.024780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.26108","last_updated":"2026-06-06T16:11:19Z","snapshot_observed_at":"2026-08-02T21:36:48.643552Z","submitted_at":"2026-05-25T17:59:21Z","title":"Reinforcing Few-step Generators via Reward-Tilted Distribution Matching","version":3},"cited_work":{"arxiv_id":"2605.26108","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.26108","snapshot_observed_at":"2026-08-11T21:17:27.604919Z","title":"Reinforcing Few-step Generators via Reward-Tilted Distribution Matching","venue":"cs.CV","work_id":"1a12cdbc-5ab4-422d-b70e-f40630963ad2","year":2026},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:25.974465Z"},"links":{"cited_paper":"/paper/2605.26108","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:43cfe73f6da7fd70865ce43265bfbb2f9d1a1b77f5a23097c06363bfaacda54f","observation_id":"be0e1a16-fb43-456c-92b7-5598315f6930","resolution":{"observed_at":"2026-08-11T21:17:27.654762Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-11T21:17:25.964609Z","title":"Classifier-free diffusion guidance.arXiv preprint arXiv:2207.12598,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:25.964609Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:e27075ebee46029e1eab4a60d93e5842589939d533f205d9015a0b15a5934684","observation_id":"cd14edf4-76b2-492d-bce1-b10f91f398f6","resolution":{"observed_at":"2026-08-11T21:17:25.964609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:17:25.951206Z","title":"Rdm: Re-conceptualizing distribution matching as a reward for diffusion distillation.arXiv preprint arXiv:2603.28460,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:25.951206Z"},"links":{"citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:c4ad52126705bb960fde08f94782249dd0ee6816c48d35fb2e6068dadab533ff","observation_id":"7ededbd3-4a34-4779-850e-d592ca3d1107","resolution":{"observed_at":"2026-08-11T21:17:25.951206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.02388","last_updated":"2021-01-07T06:12:28Z","snapshot_observed_at":"2026-07-06T10:30:38.112588Z","submitted_at":"2021-01-07T06:12:28Z","title":"Knowledge Distillation in Iterative Generative Models for Improved Sampling Speed","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.02388","snapshot_observed_at":"2026-08-11T21:17:26.109193Z","title":"Knowledge distillation in iterative generative models for improved sampling speed.arXiv preprint arXiv:2101.02388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:26.109193Z"},"links":{"cited_paper":"/paper/2101.02388","citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:21cdf858fe31045dadb7b738fe4db41103ab892bce1c6b726b0cac9ad5e61327","observation_id":"7a4f1880-265e-4a55-9d69-9cd75a243207","resolution":{"observed_at":"2026-08-11T21:17:26.109193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:17:28.300105Z","title":"Nft: Bridging supervised learning and reinforcement learning in math reasoning","venue":null,"work_id":"f6f52385-507e-4693-8ad5-ea52587012e0","year":2026},"citing_paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-11T21:17:25.910457Z"},"links":{"citing_paper":"/paper/2608.09226"},"observation_digest":"sha256:55308fcbd0bad1f8403ef1d24d41f6682a30f28a506140742f7615a6012943d4","observation_id":"e2a10241-16b8-4513-b328-2d4e8bdb95de","resolution":{"observed_at":"2026-08-11T21:17:28.329247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.09226","last_updated":"2026-08-10T07:49:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T12:23:45.367182Z","submitted_at":"2026-08-10T07:49:05Z","title":"RL-Native Distillation: Exploiting Scored Trajectories for Few-Step Image Generation"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2608.09226."}