{"as_of":"2026-08-06T16:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:79e9d05a87276dc23e36b181ebb2b7e3a96a919d9dfb586103fc9bd896fb3b82","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:42:22.457966Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:10:44.244790Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T07:14:20.959214Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"cited_work":{"arxiv_id":"2508.21016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21016","snapshot_observed_at":"2026-06-30T07:14:20.959214Z","title":"Inference-time alignment control for diffusion models with reinforcement learning guidance","venue":null,"work_id":"cb0aeaa8-80a2-4b68-8b5a-e8737cdce98b","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2508.21016","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:b2191da27115cc4229c8f1f88574ed6d7f13692e3b6b5a875b8f2c47fef58bc0","observation_id":"6674a156-2fbb-43f2-9c5f-0341df19c5b6","resolution":{"observed_at":"2026-05-13T16:54:31.010581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"cited_work":{"arxiv_id":"2508.21016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21016","snapshot_observed_at":"2026-06-30T07:14:20.959214Z","title":"Inference-time alignment control for diffusion models with reinforcement learning guidance","venue":null,"work_id":"cb0aeaa8-80a2-4b68-8b5a-e8737cdce98b","year":2025},"citing_paper":{"arxiv_id":"2605.04494","last_updated":"2026-05-06T04:50:42Z","snapshot_observed_at":"2026-07-31T05:58:54.504742Z","submitted_at":"2026-05-06T04:50:42Z","title":"Towards General Preference Alignment: Diffusion Models at Nash Equilibrium","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T16:54:58.732444Z"},"links":{"cited_paper":"/paper/2508.21016","citing_paper":"/paper/2605.04494"},"observation_digest":"sha256:9f0a17ea9f2dabb31eb9ae70eb5dd785b9a7e4ffa0a05cbdf3986e50a98bfcb0","observation_id":"a4fb9b96-bf1d-4ddb-bb27-01dc1c977e51","resolution":{"observed_at":"2026-05-11T17:56:06.972632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"cited_work":{"arxiv_id":"2508.21016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21016","snapshot_observed_at":"2026-06-30T07:14:20.959214Z","title":"Inference-time alignment control for diffusion models with reinforcement learning guidance","venue":null,"work_id":"cb0aeaa8-80a2-4b68-8b5a-e8737cdce98b","year":2025},"citing_paper":{"arxiv_id":"2606.30376","last_updated":"2026-06-29T14:37:36Z","snapshot_observed_at":"2026-08-06T14:01:33.723954Z","submitted_at":"2026-06-29T14:37:36Z","title":"FlowAWR: Online Adaptive Flow Reinforcement via Advantage-Weighted Rectification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T07:10:44.244790Z"},"links":{"cited_paper":"/paper/2508.21016","citing_paper":"/paper/2606.30376"},"observation_digest":"sha256:ce7946468b397be8a0e64e47aa128c5997e27839c94be23d2c0acf3895b42802","observation_id":"fb3adc17-f5fd-4baa-a50b-90e33b0a143d","resolution":{"observed_at":"2026-06-30T07:14:20.961281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.21016/citation-record","integrity":"/paper/2508.21016/integrity","json":"/paper/2508.21016/citation-record.json","paper":"/paper/2508.21016"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.129723Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.129723Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:d7a36f78f79db391a0132002b5b1921c9814025d2b58e8dc4462ce4e6f4dcba3","observation_id":"adfc3e4c-ff7a-411f-b5c9-795c3ef9f0f3","resolution":{"observed_at":"2026-08-05T14:42:22.129723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.135394Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.135394Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:a466f3b810d980b48efff986dacafe80404ff2978b5cdc63bb772623b666f11c","observation_id":"7749846b-3fe2-4b42-adb7-26910a877101","resolution":{"observed_at":"2026-08-05T14:42:22.135394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.662899Z","title":null,"venue":null,"work_id":"250e2621-bbc4-4fca-90bb-9242d26f7700","year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.143215Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:61f6f093ddd88954e882cf437132751c1928446aeae216cfcebe67f0236037a5","observation_id":"3458c617-ac39-4146-87a9-0dfe06b458d1","resolution":{"observed_at":"2026-08-05T14:42:23.668973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-01T15:43:51.739518Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-05T14:42:22.148482Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.148482Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:3314ed5b4a4fe45dcf19d80586d469006e0e6b13edf50f5c8211fa16e892158e","observation_id":"6f991acc-92d2-4ab6-87ba-6bb34af8a437","resolution":{"observed_at":"2026-08-05T14:42:22.148482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09000","last_updated":"2024-08-23T17:21:35Z","snapshot_observed_at":"2026-07-06T19:01:45.542387Z","submitted_at":"2024-08-16T20:00:55Z","title":"Classifier-Free Guidance is a Predictor-Corrector","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09000","snapshot_observed_at":"2026-08-05T14:42:22.154328Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.154328Z"},"links":{"cited_paper":"/paper/2408.09000","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:1e7bd07a24500d2c0fdcbb313cbb53c5ce6ac09bfc3ee91ec6601ad17d39e5e2","observation_id":"ed72c517-5e42-4777-91cf-93adc6dd41f1","resolution":{"observed_at":"2026-08-05T14:42:22.154328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21834","last_updated":"2026-04-12T01:02:59Z","snapshot_observed_at":"2026-08-02T05:26:21.940391Z","submitted_at":"2025-06-27T00:47:07Z","title":"PrefPaint: Enhancing Medical Image Inpainting through Expert Human Feedback","version":2},"cited_work":{"arxiv_id":"2506.21834","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21834","snapshot_observed_at":"2026-08-05T14:42:23.290665Z","title":"PrefPaint: Enhancing Medical Image Inpainting through Expert Human Feedback","venue":"cs.CV","work_id":"8d6c8abf-d4cb-4f53-9f80-721295c46e61","year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.160551Z"},"links":{"cited_paper":"/paper/2506.21834","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:2c12599ab83078242ba303a35f96e0d852c37f823716d453007e7fa4229bb02d","observation_id":"56785e19-4ba3-4acd-8221-afbd7bc3d6ac","resolution":{"observed_at":"2026-08-05T14:42:23.298058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.167273Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.167273Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:4e9c2c2adaa3598177d22016c2bb807d7dc2c0195ba413e7bd38fe5151403528","observation_id":"304f57c7-e897-46a5-b7c1-f449696b9cb4","resolution":{"observed_at":"2026-08-05T14:42:22.167273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01527","last_updated":"2022-06-15T20:58:09Z","snapshot_observed_at":"2026-08-06T03:07:55.969083Z","submitted_at":"2021-12-02T18:59:58Z","title":"Masked-attention Mask Transformer for Universal Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01527","snapshot_observed_at":"2026-08-05T14:42:22.172732Z","title":"G.; Kirillov, A.; and Girdhar, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.172732Z"},"links":{"cited_paper":"/paper/2112.01527","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:825fd592800c188c96df771b426e809078f4ad12ba152d307882d3142cc67dcf","observation_id":"7b737d5e-61b9-4f3b-9691-8ab6edf40637","resolution":{"observed_at":"2026-08-05T14:42:22.172732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.179641Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.179641Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:ebac9370f4597a1157bacfb82ef4503634a9fbefc3a837bcc7328b80519f379a","observation_id":"cddf071c-3a23-402e-b3d8-965bcde8eeaf","resolution":{"observed_at":"2026-08-05T14:42:22.179641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08070","last_updated":"2024-09-12T04:39:16Z","snapshot_observed_at":"2026-07-06T18:29:30.075334Z","submitted_at":"2024-06-12T10:40:10Z","title":"CFG++: Manifold-constrained Classifier Free Guidance for Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08070","snapshot_observed_at":"2026-08-05T14:42:22.185076Z","title":"Y.; Nam, H.; and Ye, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.185076Z"},"links":{"cited_paper":"/paper/2406.08070","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:8c10ac2c76f4cea410a3b3822d8965ae8f4e22377456562caa6b64999a9a31a9","observation_id":"4c8f76b2-7df2-467d-ba51-cc68b1d6ada2","resolution":{"observed_at":"2026-08-05T14:42:22.185076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17400","last_updated":"2024-06-21T16:45:11Z","snapshot_observed_at":"2026-08-06T10:08:54.816113Z","submitted_at":"2023-09-29T17:01:02Z","title":"Directly Fine-Tuning Diffusion Models on Differentiable Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17400","snapshot_observed_at":"2026-08-05T14:42:22.194389Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.194389Z"},"links":{"cited_paper":"/paper/2309.17400","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:ba300884d329d6420f5f549a1d0e1f0b79a454ed2dfa59da322393509dbfa6d9","observation_id":"1f3cbfdb-5f44-4ee7-81a6-de6417e866a0","resolution":{"observed_at":"2026-08-05T14:42:22.194389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-05T14:42:22.199726Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.199726Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:c86a63ee576a2606cc7a49b18e4c3ead3f954d4b5cbc605014a5cae267cc043c","observation_id":"5465019d-c0e2-4632-a8c3-1667283e239f","resolution":{"observed_at":"2026-08-05T14:42:22.199726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.633201Z","title":null,"venue":null,"work_id":"63640091-07be-4c03-baee-bf986fe81b7c","year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.204773Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:0d9ce4dc2ab088012b622e02135baac556e382a2afe73025800b46fa9956f3c4","observation_id":"7c02521e-4250-43a0-93f6-f6e08bd8a148","resolution":{"observed_at":"2026-08-05T14:42:23.638508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-05T14:42:22.209359Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.209359Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:7bc32d7cef76a0abb98d19c933379dbd2abb2af86312e5e20c7b2e9dbf4f5457","observation_id":"c0a4618d-1253-49ef-b432-cdf07356bcb5","resolution":{"observed_at":"2026-08-05T14:42:22.209359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06061","last_updated":"2025-02-09T22:45:15Z","snapshot_observed_at":"2026-08-03T22:14:08.303978Z","submitted_at":"2025-02-09T22:45:15Z","title":"Online Reward-Weighted Fine-Tuning of Flow Matching with Wasserstein Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06061","snapshot_observed_at":"2026-08-05T14:42:22.214222Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.214222Z"},"links":{"cited_paper":"/paper/2502.06061","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:68228c950c4bbf1b9681fdfc21930d8212afc7af5f986b792a39f59fa449a9df","observation_id":"5b73787a-0011-4fb3-8fcf-a88a0e1b9001","resolution":{"observed_at":"2026-08-05T14:42:22.214222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18886","last_updated":"2025-04-03T09:03:32Z","snapshot_observed_at":"2026-07-06T20:57:52.146394Z","submitted_at":"2025-03-24T16:59:57Z","title":"CFG-Zero*: Improved Classifier-Free Guidance for Flow Matching Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18886","snapshot_observed_at":"2026-08-05T14:42:22.219088Z","title":"Y.; Yeh, R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.219088Z"},"links":{"cited_paper":"/paper/2503.18886","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:4e72fcbf3bc63bdeb713fd5260af7a81ce1cb852b101bf3e63429cee23b6284f","observation_id":"8575a2c6-fc01-49ce-b6a8-64bd81386868","resolution":{"observed_at":"2026-08-05T14:42:22.219088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23458","last_updated":"2025-05-29T14:06:50Z","snapshot_observed_at":"2026-07-06T21:32:57.510891Z","submitted_at":"2025-05-29T14:06:50Z","title":"Diffusion Guidance Is a Controllable Policy Improvement Operator","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23458","snapshot_observed_at":"2026-08-05T14:42:22.223628Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.223628Z"},"links":{"cited_paper":"/paper/2505.23458","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:9204367b267bf13be2208e87c0b854196d5d5949ad98e63dcf5cc1166e437d70","observation_id":"56e107ec-6e8c-4c85-a1b2-0b52646da785","resolution":{"observed_at":"2026-08-05T14:42:22.223628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.614856Z","title":null,"venue":null,"work_id":"8c3368cf-1660-49db-b111-ecb6adc99f8d","year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.228358Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:8a9ecb686ab1ae39320d5ce6f6d0f89c936d1e3da1e5d515bf837ada9eb35df0","observation_id":"76ed0a85-9501-4c3c-abaf-e9390e43b717","resolution":{"observed_at":"2026-08-05T14:42:23.620552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20639","last_updated":"2025-06-26T15:46:40Z","snapshot_observed_at":"2026-08-01T20:24:21.885586Z","submitted_at":"2025-06-25T17:35:47Z","title":"DiffuCoder: Understanding and Improving Masked Diffusion Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20639","snapshot_observed_at":"2026-08-05T14:42:22.236761Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.236761Z"},"links":{"cited_paper":"/paper/2506.20639","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:e4f692367e049bdfb6f0a411995176b877d718be5241847320cbb0823217afd9","observation_id":"221f89fb-3a73-4331-9671-19a81ecf03de","resolution":{"observed_at":"2026-08-05T14:42:22.236761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.241643Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.241643Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:0bfba94e433c8e66aeb16488661dfc11f2dd8f6fda27f05672d38163fe1045d6","observation_id":"768c7664-f57e-49fb-87f7-e3afe05f5220","resolution":{"observed_at":"2026-08-05T14:42:22.241643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T14:42:22.246069Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.246069Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:4b6663bcda585fb08459ac19e00c59791dea23fa89cf0d123dc80a3870ef0900","observation_id":"b05b307f-f8b5-4cab-87c5-c840d0a02599","resolution":{"observed_at":"2026-08-05T14:42:22.246069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.587404Z","title":null,"venue":null,"work_id":"4b5300fb-4100-46cd-aeb3-f20e43698222","year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.250855Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:c1b9971df54b5e55c1a8cfccbe15eeefc775dd866dda0b5628da911ea12e9809","observation_id":"c97259dd-7afb-4d2e-ba2f-0afb4f919504","resolution":{"observed_at":"2026-08-05T14:42:23.593229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.570607Z","title":null,"venue":null,"work_id":"5e521874-d5b7-449b-b9d2-a0bbb2b7b853","year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.255448Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:c79f8321586162b1262d98af9fde6d9deb9fad49f8e04a540528950070730036","observation_id":"828132b4-1a46-49e5-a446-68bfdcad2680","resolution":{"observed_at":"2026-08-05T14:42:23.575591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01569","last_updated":"2023-11-23T17:07:58Z","snapshot_observed_at":"2026-08-05T16:14:24.029428Z","submitted_at":"2023-05-02T16:18:11Z","title":"Pick-a-Pic: An Open Dataset of User Preferences for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01569","snapshot_observed_at":"2026-08-05T14:42:22.259928Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.259928Z"},"links":{"cited_paper":"/paper/2305.01569","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:f3f159a30a2c5de3fd96f45f836267f66d9cc0c9ef5830d25bca53d089bfc1fb","observation_id":"61bcc3c4-df59-47f4-a972-b591474cea3b","resolution":{"observed_at":"2026-08-05T14:42:22.259928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T14:42:22.264641Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.264641Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:ae9436aa7225155d949a0808cbd2d9f9a2eae98da947cec8939e8bc291819514","observation_id":"2e1a7866-4c6d-4c1a-90a4-0b68584b0c53","resolution":{"observed_at":"2026-08-05T14:42:22.264641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-05T14:42:22.270001Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.270001Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:da50be55d96dcbe743cc8f71ff6a21d396627d6eae5c7155e29e9a13c9776ac1","observation_id":"a1195b3a-2b1b-4f4f-bce8-e7854c0f46bf","resolution":{"observed_at":"2026-08-05T14:42:22.270001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-05T14:42:22.275222Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.275222Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:b7f25b3d7b1f1e26324559b740fbaec20de4d31aa4060e7df37bfaea8da6a439","observation_id":"0e181c30-f54a-4486-95be-d5e9ec5dbe92","resolution":{"observed_at":"2026-08-05T14:42:22.275222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-05T14:42:22.280733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.280733Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:7b96b96200a1c32a5dc63274be24f2987ab97ccabcb1babd2cf09de2c3ec8491","observation_id":"9e3f21ad-9081-4c4f-b264-8e22dd71db05","resolution":{"observed_at":"2026-08-05T14:42:22.280733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T14:42:22.285749Z","title":"T.; Ben-Hamu, H.; Nickel, M.; and Le, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.285749Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:9b50e21f318337cbb6e4780f552995d37cd0797df2ad3a22a8c775484a2b2025","observation_id":"2057f0dc-e59f-4592-9d2d-d65e6146a1fa","resolution":{"observed_at":"2026-08-05T14:42:22.285749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.291508Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.291508Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:a53cdf8ffc9c2374710a010c854841ccfd877292b990ec6b38d7520092e3ada6","observation_id":"052041bf-f72c-4588-b694-ec3c62b8be08","resolution":{"observed_at":"2026-08-05T14:42:22.291508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06782","last_updated":"2025-02-12T10:07:07Z","snapshot_observed_at":"2026-08-01T22:33:03.722976Z","submitted_at":"2025-02-10T18:58:11Z","title":"Lumina-Video: Efficient and Flexible Video Generation with Multi-scale Next-DiT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06782","snapshot_observed_at":"2026-08-05T14:42:22.295895Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.295895Z"},"links":{"cited_paper":"/paper/2502.06782","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:fa2223a53cb4af28c7a4d7abd9c28d1d5a48b4b32ceadf4a09dacd1039543162","observation_id":"60d87b09-6a4d-4dd1-8425-f695b0ec1a0c","resolution":{"observed_at":"2026-08-05T14:42:22.295895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-06T11:11:00.378627Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-08-05T14:42:22.301547Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.301547Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:502ad5de713c8a7dc328ef082ddfed498dd6131193a137e3ac7c6b70cd67be7b","observation_id":"281d1151-1fa6-4a4e-9e2b-8c1f98fa3d35","resolution":{"observed_at":"2026-08-05T14:42:22.301547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-05T14:42:22.307315Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.307315Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:7cf4d07d0e8b622e21d860fde1d726d3b76b342cb99a088713b9746b028b995d","observation_id":"b12ae850-7b16-4c10-805f-31fbfd4f1039","resolution":{"observed_at":"2026-08-05T14:42:22.307315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.312178Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.312178Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:e5a0650a494c94c92085a7ef154daf1641c6a851f2475c3b7b512bbafa582bba","observation_id":"9e942faf-4539-4ea9-8ff8-5bc4e1c193c7","resolution":{"observed_at":"2026-08-05T14:42:22.312178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.543835Z","title":null,"venue":null,"work_id":"5e7b28c8-96dd-43ce-aeea-20a428543fc4","year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.317146Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:a8cd1c4de2439b5e13f803a4c17fa300b249f20ddeda1565e729c28d88d5152b","observation_id":"0c62698a-b136-4733-ab0f-6bb80427dfe0","resolution":{"observed_at":"2026-08-05T14:42:23.548625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.526297Z","title":null,"venue":null,"work_id":"e1452e44-94c5-4f2b-b4c5-ea4dae529739","year":1999},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.321701Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:82d8ef7b8b1bc33e995dfb540e98f445808db996ba9d2e5834eeb125a471841a","observation_id":"74cf2b01-4e6b-4cbe-990c-f68593a31c32","resolution":{"observed_at":"2026-08-05T14:42:23.531113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-05T14:42:22.326127Z","title":"???? Simple and Scalable Off-Policy Reinforcement Learning","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.326127Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:4ca643f4d258743f95a510f30e7cd3c0641c1301c29cdee7ec70b67bd02a3a18","observation_id":"0e5c2df1-3b3f-40ed-9854-8c2889f00b69","resolution":{"observed_at":"2026-08-05T14:42:22.326127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-05T14:42:22.330799Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.330799Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:86d4bfbb1e396cf708f97a4bdbbd0b4ffce51b54b7d951c28f158a682c3b70e3","observation_id":"4c5bd75d-e8e1-49e2-aa06-5ac443293669","resolution":{"observed_at":"2026-08-05T14:42:22.330799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.509985Z","title":null,"venue":null,"work_id":"99fd320b-1dc9-4009-ab4e-de34c5b08cfa","year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.335656Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:8f9360cc89e06c0c42086bbd5d86ee1eb13c645d4400770c1af6dbe5d5aa67da","observation_id":"7cdceb0a-4e7e-4be4-8d08-d5f493990d01","resolution":{"observed_at":"2026-08-05T14:42:23.514920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-05T14:42:22.340041Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; Krueger, G.; and Sutskever, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.340041Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:5a050602a41c3e94049aa47a52440a0948a86feccdc1065ce2e2f97655a20ee7","observation_id":"0c2b9ab9-deeb-41f9-b4e5-624a56116996","resolution":{"observed_at":"2026-08-05T14:42:22.340041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12358","last_updated":"2024-08-12T21:13:35Z","snapshot_observed_at":"2026-07-06T18:02:19.428801Z","submitted_at":"2024-04-18T17:37:02Z","title":"From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12358","snapshot_observed_at":"2026-08-05T14:42:22.344947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.344947Z"},"links":{"cited_paper":"/paper/2404.12358","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:1e42984966f2bac584ac774dfd92ac9c8d30c3f2384774b293ee3cd3f5de929d","observation_id":"506981d4-0316-4bc6-be19-363c8232b831","resolution":{"observed_at":"2026-08-05T14:42:22.344947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.349971Z","title":"D.; Ermon, S.; and Finn, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.349971Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:6fb64d3ea9b6e2a921095f121b051dbab31fda31448152da653e275ea4330507","observation_id":"410a884b-1889-4fa0-8759-aa64e1820ae6","resolution":{"observed_at":"2026-08-05T14:42:22.349971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.354571Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.354571Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:d1cb7a4f4159e65ee3b5339e5e73de8763ff64213d4e55669cabbb7f2a4dcb35","observation_id":"7f58168f-ffa2-4e1a-8301-abe13d006b47","resolution":{"observed_at":"2026-08-05T14:42:22.354571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.359936Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.359936Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:7f71ee391792ccd1f42adfe710879edec20a1ca2231f446f5e7eef735e509b1a","observation_id":"b21c10ea-7e63-4108-8bec-b8b4d627db30","resolution":{"observed_at":"2026-08-05T14:42:22.359936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.461814Z","title":null,"venue":null,"work_id":"65ec95b4-6910-4aff-a1b8-ea1664eb5627","year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.364590Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:21aa9c07f56182c97d26862a0c5e96070bad9aa3156613189325264b2b6586af","observation_id":"6aaf30ea-0ec4-44a1-9d12-f3031577a7fd","resolution":{"observed_at":"2026-08-05T14:42:23.467023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.444610Z","title":null,"venue":null,"work_id":"3d1c7fa8-63e7-462f-aafe-ac3b20135dd2","year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.369687Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:39cd27fffdcbecb61c26f9df5bb1aececf416fbb7e9475ee8ee7d7762f0bfa62","observation_id":"2cee3b5a-d185-456f-922c-40af865bfa62","resolution":{"observed_at":"2026-08-05T14:42:23.450161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T14:42:22.375167Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.375167Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:6737daf651f0826cb9361ed8f0dedf64e3ef14c1941bc934e7d554945aacc156","observation_id":"a1d1980c-d34a-4fce-90d4-86515ab12e5a","resolution":{"observed_at":"2026-08-05T14:42:22.375167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T14:42:22.381637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.381637Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:1638a27c1e29b11231717c6ac1d416307872bda794041c45260cde09f66091d2","observation_id":"fe7eb3a0-829a-4352-9bdd-6173339a1843","resolution":{"observed_at":"2026-08-05T14:42:22.381637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02819","last_updated":"2025-06-08T05:40:55Z","snapshot_observed_at":"2026-07-06T20:46:41.601428Z","submitted_at":"2025-03-04T17:46:51Z","title":"Feynman-Kac Correctors in Diffusion: Annealing, Guidance, and Product of Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02819","snapshot_observed_at":"2026-08-05T14:42:22.387984Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.387984Z"},"links":{"cited_paper":"/paper/2503.02819","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:266b71fb7f59d03e904d0e210e8642922e3ee1674ca88e25b37bdd64892974cf","observation_id":"e1e67a8e-2637-4a3f-b8ca-b11796ff644a","resolution":{"observed_at":"2026-08-05T14:42:22.387984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T14:42:22.393601Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.393601Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:98133bc35e646a5fd5b743046dd277faaf5a394448dbd41ccd3dc9a2a81c3dbe","observation_id":"6863f946-2ed8-4327-879a-be101727b78e","resolution":{"observed_at":"2026-08-05T14:42:22.393601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-05T14:42:22.399991Z","title":"P.; Kumar, A.; Ermon, S.; and Poole, B","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.399991Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:577d5b9e0d98fae23437c7771946b342f7484ea0ce7371460df407633729059c","observation_id":"6961d1a9-94a6-4f57-8a5c-a70ea13c91c4","resolution":{"observed_at":"2026-08-05T14:42:22.399991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02407","last_updated":"2025-04-22T10:49:31Z","snapshot_observed_at":"2026-07-06T21:03:35.698923Z","submitted_at":"2025-04-03T08:57:15Z","title":"F5R-TTS: Improving Flow-Matching based Text-to-Speech with Group Relative Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02407","snapshot_observed_at":"2026-08-05T14:42:22.405894Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.405894Z"},"links":{"cited_paper":"/paper/2504.02407","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:18c5d5413a550c9a72fd510d93b4c45f2612ad9753e4223794f7926bdcb16dfb","observation_id":"c4e63a3a-d6be-4b11-9a66-f6f111ac4947","resolution":{"observed_at":"2026-08-05T14:42:22.405894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00482","last_updated":"2024-03-11T14:27:48Z","snapshot_observed_at":"2026-07-06T14:47:04.817434Z","submitted_at":"2023-02-01T14:47:17Z","title":"Improving and generalizing flow-based generative models with minibatch optimal transport","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00482","snapshot_observed_at":"2026-08-05T14:42:22.410951Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.410951Z"},"links":{"cited_paper":"/paper/2302.00482","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:6c58c9db24e728751f5725f367ad13eb37a8714f15328d45a13036a1de02a46a","observation_id":"353e51e4-fb10-4da7-9abe-5c4b661d1f2c","resolution":{"observed_at":"2026-08-05T14:42:22.410951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18548","last_updated":"2025-03-13T16:48:34Z","snapshot_observed_at":"2026-08-04T13:35:41.508269Z","submitted_at":"2025-02-25T15:56:56Z","title":"What is the Alignment Objective of GRPO?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18548","snapshot_observed_at":"2026-08-05T14:42:22.416055Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.416055Z"},"links":{"cited_paper":"/paper/2502.18548","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:7be06592b6a9dabd971fd216bf4cdee7782229f9052799a6365562659ec39797","observation_id":"abe3e218-3c61-4a80-9874-7cd98d65b5ff","resolution":{"observed_at":"2026-08-05T14:42:22.416055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.428553Z","title":null,"venue":null,"work_id":"da222169-17d0-403f-a5cb-3c03c7025897","year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.421027Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:081dbca868b4419d206ad4f10740afbd199ee80ca461c657bf430e44aaa8f75e","observation_id":"68f4abfb-8c0b-4976-8c74-286b39d2b6ef","resolution":{"observed_at":"2026-08-05T14:42:23.433202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T14:42:22.425577Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.425577Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:85c7c757e2d3f3f1ef038e3c2fa303e303ee7d2ac9ad5b91c2cde019c98cbc39","observation_id":"62bb897e-36e3-40ae-8ca4-72e9363200ce","resolution":{"observed_at":"2026-08-05T14:42:22.425577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.412719Z","title":null,"venue":null,"work_id":"a1d19360-04ff-4078-8fbd-6eadf9f1e812","year":1992},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.430721Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:2a92fa4498f7ba274120a585e8b07bc6d397724aa02c54df22c41624e03ecc64","observation_id":"44622b7b-0a22-457a-b400-959c20f5e6e8","resolution":{"observed_at":"2026-08-05T14:42:23.417523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.393589Z","title":null,"venue":null,"work_id":"8689402d-5410-4384-8077-1b917d3d9553","year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.435770Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:613ab5255edf579899abb9ce058a19c8f03a0f1c93e9d8f2c475d8fe3a1d16d6","observation_id":"cca8fd07-7dfe-4271-b53f-18e569c19dd2","resolution":{"observed_at":"2026-08-05T14:42:23.399598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T14:42:22.441703Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.441703Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:8cf8f73c933062a334f2c96412b06cd9075e6e18aa954f99aa986471e9292698","observation_id":"8be7027c-db0b-463f-8eef-c1cfa47eaa20","resolution":{"observed_at":"2026-08-05T14:42:22.441703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.372974Z","title":null,"venue":null,"work_id":"96d1ec55-a9be-467d-8045-e4721f3f7793","year":2007},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.447275Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:08c9d2ff53c3486179a0ba2dfe18247347bc94c5d62a075dc665f80c112b0595","observation_id":"6fc77f98-4575-4218-8e62-c84e9a7b0553","resolution":{"observed_at":"2026-08-05T14:42:23.378995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13443","last_updated":"2023-12-07T20:49:03Z","snapshot_observed_at":"2026-07-06T16:51:10.736675Z","submitted_at":"2023-11-22T15:07:59Z","title":"Guided Flows for Generative Modeling and Decision Making","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13443","snapshot_observed_at":"2026-08-05T14:42:22.452258Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.452258Z"},"links":{"cited_paper":"/paper/2311.13443","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:6ec0f4f0c47403e99fd36b7a74d79d4b833801b73cef2435b7830598f9503ba1","observation_id":"8011e350-6a7b-424d-8960-13d85d075101","resolution":{"observed_at":"2026-08-05T14:42:22.452258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.352771Z","title":null,"venue":null,"work_id":"b8238eef-3ed8-491f-8d79-cc65726263c7","year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.457966Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:529415dc31548b86c13cb5bf008ad44bc164b928d041161636be8e382076d337","observation_id":"1bc722fa-6767-4acd-b577-a6dde6f7111c","resolution":{"observed_at":"2026-08-05T14:42:23.358216Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 3 inbound Pith citation observations for arXiv:2508.21016."}