{"as_of":"2026-08-19T16:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:886f4573b91bb6ec81388507389ec4fbf08232bc5423124439c43306ab7a9286","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":58,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:48:18.544359Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T06:14:38.555744Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-12T14:48:30.702335Z","title":"Fine-tuning of continuous-time diffusion models as entropy-regularized control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14913","last_updated":"2025-04-25T21:42:58Z","snapshot_observed_at":"2026-08-15T04:19:42.201060Z","submitted_at":"2024-11-22T13:14:54Z","title":"Enhancing Exploration with Diffusion Policies in Hybrid Off-Policy RL: Application to Non-Prehensile Manipulation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T14:48:30.702335Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2411.14913"},"observation_digest":"sha256:eb95d458cf1212d57ff5c437d7d8d75efc67caf7251ecb4f95123c10e71f35c3","observation_id":"5d8a776e-3d03-4c7d-98f3-7f5eed0ee754","resolution":{"observed_at":"2026-08-12T14:48:30.702335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-11T22:38:32.747952Z","title":"L., Tseng, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03293","last_updated":"2025-06-04T08:30:06Z","snapshot_observed_at":"2026-08-16T21:12:40.974751Z","submitted_at":"2024-12-04T13:11:38Z","title":"Diffusion-VLA: Generalizable and Interpretable Robot Foundation Model via Self-Generated Reasoning","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T22:38:32.747952Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2412.03293"},"observation_digest":"sha256:319acaaf88f200ed63afeb35e2fbafc8e6aa7bb1674cd0fd0fec9c3390afe490","observation_id":"df6887dc-8750-4568-a4cd-1e143c92e2e0","resolution":{"observed_at":"2026-08-11T22:38:32.747952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-11T18:35:18.610551Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07775","last_updated":"2025-05-17T20:13:19Z","snapshot_observed_at":"2026-08-16T19:40:40.528828Z","submitted_at":"2024-12-10T18:59:58Z","title":"Efficient Diversity-Preserving Diffusion Alignment via Gradient-Informed GFlowNets","version":6},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:18.610551Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2412.07775"},"observation_digest":"sha256:4e2d4f9a78726b8f055c2fb0e58c1d93d0793950e554d9009487a038c2d038ae","observation_id":"2318703c-9446-4614-8758-70adfcf8b413","resolution":{"observed_at":"2026-08-11T18:35:18.610551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-09T14:29:12.427168Z","title":"L., Tseng, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-15T03:50:46.755327Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.427168Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:887338a0ee7cec12f1d5602dad592b3c922199dd435b0ae561832cba003175cd","observation_id":"68fbedcb-4df2-4a7d-8e21-43ba93e5d1a7","resolution":{"observed_at":"2026-08-09T14:29:12.427168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-09T10:36:54.521232Z","title":"Fine-tuning of continuous-time diffusion models as entropy-regularized control, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02954","last_updated":"2025-03-06T01:25:25Z","snapshot_observed_at":"2026-08-16T07:46:23.762941Z","submitted_at":"2025-02-05T07:35:15Z","title":"Direct Distributional Optimization for Provable Alignment of Diffusion Models","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T10:36:54.521232Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2502.02954"},"observation_digest":"sha256:a97edd653559411a47d76506d9bd7e5b52ed3d6874d5c3e40a531b48469b5207","observation_id":"057b9782-9fbe-4cd3-91ef-09d2882e0091","resolution":{"observed_at":"2026-08-09T10:36:54.521232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-08T22:54:25.028899Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.028899Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:e8d06114a526eb722d8288bf7c7579f1c805e05956a1b16d972e2378a12a3018","observation_id":"4dc077ae-75a6-43dc-b3e4-6a18e360a941","resolution":{"observed_at":"2026-08-08T22:54:25.028899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2502.05855","last_updated":"2025-08-09T10:58:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-09T11:25:56Z","title":"DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-14T19:48:48.725800Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2502.05855"},"observation_digest":"sha256:d90252e821d9ddd1b7f2212ba84ec9e8f32b762659b8cdb2803f93bdb8a7f0e0","observation_id":"80ab42bc-d089-4cd8-84b9-351315ac080a","resolution":{"observed_at":"2026-05-14T19:48:48.840440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-08T14:14:14.887804Z","title":"L., Tseng, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06999","last_updated":"2025-05-28T14:58:36Z","snapshot_observed_at":"2026-08-17T05:57:22.564371Z","submitted_at":"2025-02-10T19:49:54Z","title":"Outsourced diffusion sampling: Efficient posterior inference in latent spaces of generative models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T14:14:14.887804Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2502.06999"},"observation_digest":"sha256:688128130e22fa876e8ca7937f76ea7f6fb26ca67145ac84a4687b2fd5efc49c","observation_id":"2cae4956-7c19-4aa6-b38b-731be3b40efc","resolution":{"observed_at":"2026-08-08T14:14:14.887804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-07T23:43:38.026069Z","title":"L., Tseng, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08808","last_updated":"2025-08-05T16:27:52Z","snapshot_observed_at":"2026-08-16T15:50:06.882936Z","submitted_at":"2025-02-12T21:44:06Z","title":"A First-order Generative Bilevel Optimization Framework for Diffusion Models","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T23:43:38.026069Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2502.08808"},"observation_digest":"sha256:2a755a88df6a917ab5cc56cd8f4ed5392b49c6868f93512f0f00be6e34a7f820","observation_id":"8b3ec7d4-daf4-45d4-9a70-e76a44120b45","resolution":{"observed_at":"2026-08-07T23:43:38.026069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-07T15:18:55.480756Z","title":"Fine-tuning of continuous-time diffusion models as entropy-regularized control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15791","last_updated":"2025-06-02T17:53:20Z","snapshot_observed_at":"2026-08-14T10:14:15.966312Z","submitted_at":"2025-05-21T17:44:37Z","title":"VARD: Efficient and Dense Fine-Tuning for Diffusion Models with Value-based RL","version":2},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-07T15:18:55.480756Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2505.15791"},"observation_digest":"sha256:6ace3ad6228e1d3ff1dc05d2eb127670540b5176ed311a70c8979e30c6999e98","observation_id":"638dc0d6-b238-4d53-9b57-91a7984e2bad","resolution":{"observed_at":"2026-08-07T15:18:55.480756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-07T14:49:48.583581Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control.arXiv preprint arXiv:2402.15194, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17618","last_updated":"2025-05-23T08:25:46Z","snapshot_observed_at":"2026-08-13T12:52:39.280958Z","submitted_at":"2025-05-23T08:25:46Z","title":"Scaling Image and Video Generation via Test-Time Evolutionary Search","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:48.583581Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2505.17618"},"observation_digest":"sha256:0b407abf2b762706392c83e1e51e212470666d5a90cfec189580c1bea2810429","observation_id":"bbda7e92-67ff-4d49-90e7-b10667e46bbd","resolution":{"observed_at":"2026-08-07T14:49:48.583581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-07T13:26:00.168043Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control.arXiv preprint arXiv:2402.15194, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21906","last_updated":"2025-05-29T23:34:24Z","snapshot_observed_at":"2026-08-14T14:47:44.698063Z","submitted_at":"2025-05-28T02:48:42Z","title":"ChatVLA-2: Vision-Language-Action Model with Open-World Embodied Reasoning from Pretrained Knowledge","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:00.168043Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2505.21906"},"observation_digest":"sha256:bd1a16f61260c747b4adbbb39545420bdc995e1382ce6721ee85e57a169837f5","observation_id":"33c41de6-8225-42ea-b84a-a0d2332fb78f","resolution":{"observed_at":"2026-08-07T13:26:00.168043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-15T19:48:18.544359Z","title":"L., Tseng, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15385","last_updated":"2025-06-18T11:59:15Z","snapshot_observed_at":"2026-08-16T02:13:27.098103Z","submitted_at":"2025-06-18T11:59:15Z","title":"Provable Maximum Entropy Manifold Exploration via Diffusion Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T19:48:18.544359Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2506.15385"},"observation_digest":"sha256:413014309891aeb38c72aac392c94ebf266f726cb29e414ef5e7bbfe996d660a","observation_id":"b3aed93b-3141-4cd1-beeb-c588fbe8bd8f","resolution":{"observed_at":"2026-08-15T19:48:18.544359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-06T23:57:17.220344Z","title":"Fine-tuning of continuous-time diffusion models as entropy-regularized control.arXiv preprint arXiv:2402.15194, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15684","last_updated":"2025-06-18T17:59:59Z","snapshot_observed_at":"2026-08-16T02:12:39.480275Z","submitted_at":"2025-06-18T17:59:59Z","title":"Nabla-R2D3: Effective and Efficient 3D Diffusion Alignment with 2D Rewards","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:17.220344Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2506.15684"},"observation_digest":"sha256:23a1cb04fdef28bc21ca6b2ea56d6727ccf893e6d9f5c40648196ea35d217833","observation_id":"875a60c0-27df-45f7-a311-df60d57c3e25","resolution":{"observed_at":"2026-08-06T23:57:17.220344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-06T22:59:48.122120Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20701","last_updated":"2025-06-25T17:59:10Z","snapshot_observed_at":"2026-08-17T19:04:30.017395Z","submitted_at":"2025-06-25T17:59:10Z","title":"Diffusion Tree Sampling: Scalable inference-time alignment of diffusion models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T22:59:48.122120Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2506.20701"},"observation_digest":"sha256:df9620dabac6d7b866bc4f681732273f67d6b63cab81452238d3a216a55df343","observation_id":"e9e6fb94-0db1-4c0e-ada6-3b11fe78be1d","resolution":{"observed_at":"2026-08-06T22:59:48.122120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2507.00480","last_updated":"2026-05-07T09:04:12Z","snapshot_observed_at":"2026-08-13T20:18:03.914556Z","submitted_at":"2025-07-01T06:55:36Z","title":"Posterior Inference in Latent Space for Scalable Constrained Black-box Optimization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T07:07:33.125667Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2507.00480"},"observation_digest":"sha256:e8fc84c0a0daedc01a3addcc369803e6220ec7f52d737fa2d4156e3db820e185","observation_id":"afb509c7-0c56-4222-98ed-3e87ec365fd1","resolution":{"observed_at":"2026-05-19T07:12:09.632499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2507.05482","last_updated":"2026-05-18T13:49:11Z","snapshot_observed_at":"2026-08-13T13:39:31.094438Z","submitted_at":"2025-07-07T21:14:27Z","title":"Stein Diffusion Guidance: Training-Free Posterior Correction for Sampling Beyond High-Density Regions","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-22T00:13:51.383775Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2507.05482"},"observation_digest":"sha256:e6db9c6f30b75daac61ee7f15ed651366eda3690361d3d1aec0e5fa3617a1117","observation_id":"843b3a00-ae0c-41ef-a4af-6e14c93efd31","resolution":{"observed_at":"2026-05-22T00:14:27.755889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2507.08390","last_updated":"2026-08-06T22:52:14Z","snapshot_observed_at":"2026-08-13T22:18:55.748799Z","submitted_at":"2025-07-11T08:00:47Z","title":"Inference-Time Scaling of Diffusion Language Models via Trajectory Refinement","version":4},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-19T05:02:15.241418Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2507.08390"},"observation_digest":"sha256:3124e06b3c3f243a4a574af119d50ebee831556c0d821d5f82e1f434a666b55b","observation_id":"cd7c3216-0edc-42c3-83a5-4032b4686ff3","resolution":{"observed_at":"2026-05-19T05:02:58.781541Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-05T20:49:49.682338Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09968","last_updated":"2025-08-13T17:33:37Z","snapshot_observed_at":"2026-08-09T16:12:37.857462Z","submitted_at":"2025-08-13T17:33:37Z","title":"Noise Hypernetworks: Amortizing Test-Time Compute in Diffusion Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T20:49:49.682338Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2508.09968"},"observation_digest":"sha256:606840dd1e670c60bbc99004ac628ba793a624d39ff15694fe86886140cdb48a","observation_id":"a4f8b944-516f-4f3e-b7f5-34d9629ff514","resolution":{"observed_at":"2026-08-05T20:49:49.682338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-05T19:28:41.145544Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12518","last_updated":"2025-08-17T22:51:27Z","snapshot_observed_at":"2026-08-16T11:52:21.640254Z","submitted_at":"2025-08-17T22:51:27Z","title":"Towards Adaptive External Communication in Autonomous Vehicles: A Conceptual Design Framework","version":1},"reference_index":128,"source":"pdf_text","source_observed_at":"2026-08-05T19:28:41.145544Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2508.12518"},"observation_digest":"sha256:43f49d48558ffc4cdb2583a1e203b16816e1a5c6dd67cbbc7a1f61bac5b48d96","observation_id":"f4541949-1eb7-4f74-bc9f-7d70b7a10957","resolution":{"observed_at":"2026-08-05T19:28:41.145544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-15T16:44:36.803558Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T19:12:48.289997Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.803558Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:559a9438c5360576f37723d66644cfcc5065bc162b800133595f8b04a17048cd","observation_id":"6ee942e2-c912-4809-a2e2-485bb3e2e01f","resolution":{"observed_at":"2026-08-15T16:44:36.803558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-04T10:28:03.501643Z","title":"Fine-tuning of continuous-time diffusion models as entropy-regularized control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.10020","last_updated":"2026-05-27T20:43:16Z","snapshot_observed_at":"2026-08-14T02:52:13.954305Z","submitted_at":"2025-10-11T04:49:28Z","title":"Calibrating Generative Models to Distributional Constraints","version":4},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-04T10:28:03.501643Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2510.10020"},"observation_digest":"sha256:c0466345c9fa3baaffd9758658bb5b7fbe92aeb23785fa6079b59e528a0d3b84","observation_id":"0f858b1c-16a5-43c5-9962-38c106f29eaa","resolution":{"observed_at":"2026-08-04T10:28:03.501643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-03T20:11:27.940051Z","title":"Fine- tuning of continuous-time diffusion models as entropy- regularized control.arXiv preprint arXiv:2402.15194, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20889","last_updated":"2026-06-21T16:35:34Z","snapshot_observed_at":"2026-08-19T03:08:03.498003Z","submitted_at":"2025-11-25T22:11:51Z","title":"Test-Time Alignment of Text-to-Image Diffusion Models via Null-Text Embedding Optimisation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T20:11:27.940051Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2511.20889"},"observation_digest":"sha256:57eb424695499ca406059ddba6ae59ace0e8a4eac6baeb0429ce96798a39dfae","observation_id":"bed39288-310a-4503-af62-939ed2137136","resolution":{"observed_at":"2026-08-03T20:11:27.940051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2601.20756","last_updated":"2026-05-11T11:46:41Z","snapshot_observed_at":"2026-08-14T12:56:16.041602Z","submitted_at":"2026-01-28T16:39:39Z","title":"Supervised Guidance Training for Infinite-Dimensional Diffusion Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T10:30:01.994140Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2601.20756"},"observation_digest":"sha256:3d48bd06810aac132d37e5a75788154de96d21207d5c7d24ee829e29978f45a9","observation_id":"c6b87cec-709d-4dd4-95be-219f2f5949b7","resolution":{"observed_at":"2026-05-16T10:30:50.423051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2601.21484","last_updated":"2026-05-19T09:15:43Z","snapshot_observed_at":"2026-08-15T00:04:59.012652Z","submitted_at":"2026-01-29T10:06:52Z","title":"ETS: Energy-Guided Test-Time Scaling for Training-Free RL Alignment","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T09:37:57.120779Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2601.21484"},"observation_digest":"sha256:e148fedd05e124bc7e069ad344fd753db308b624b6714ad1803cf17ff988e140","observation_id":"6f855de1-e8c0-4a8d-9efa-319a063bbd5d","resolution":{"observed_at":"2026-05-16T09:40:49.007286Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2601.21484","last_updated":"2026-05-19T09:15:43Z","snapshot_observed_at":"2026-08-15T00:04:59.012652Z","submitted_at":"2026-01-29T10:06:52Z","title":"ETS: Energy-Guided Test-Time Scaling for Training-Free RL Alignment","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-21T14:05:37.120262Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2601.21484"},"observation_digest":"sha256:f3046ef55dede99dbb1e9502d02570421a8859528e51f3b827bf527ce6692ca3","observation_id":"6173065f-af2e-4d9c-9c8f-e4c4a21d425b","resolution":{"observed_at":"2026-05-21T14:10:13.556700Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-03T04:22:33.175337Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.05533","last_updated":"2026-06-18T02:47:04Z","snapshot_observed_at":"2026-08-17T06:41:00.352990Z","submitted_at":"2026-02-05T10:46:20Z","title":"Conditional Diffusion Guidance under Hard Constraint: A Stochastic Analysis Approach","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T04:22:33.175337Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2602.05533"},"observation_digest":"sha256:bfa077ebca14d2cd2269ea681db55b44f66748fb32a8f89233efb48885af0d33","observation_id":"016e5c60-aad8-4a68-bbee-3e974a8ae35f","resolution":{"observed_at":"2026-08-03T04:22:33.175337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-02T20:48:40.728372Z","title":"Song, Y ., Dhariwal, P., Chen, M., and Sutskever, I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22428","last_updated":"2026-06-30T19:32:14Z","snapshot_observed_at":"2026-08-16T02:13:25.935194Z","submitted_at":"2026-02-25T21:38:47Z","title":"Calibrated Test-Time Guidance for Bayesian Inference","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T20:48:40.728372Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2602.22428"},"observation_digest":"sha256:0e6b0f5d94796faef384fb9c91f6bf6020dd188d096f0974b98c32c8c293a949","observation_id":"f5ecd310-b1bf-4b2f-bc16-bf82e0f71f68","resolution":{"observed_at":"2026-08-02T20:48:40.728372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2603.12554","last_updated":"2026-05-14T15:00:13Z","snapshot_observed_at":"2026-08-16T08:49:22.781759Z","submitted_at":"2026-03-13T01:38:44Z","title":"Reinforcement Learning for Diffusion LLMs with Entropy-Guided Step Selection and Stepwise Advantages","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T12:38:02.339424Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2603.12554"},"observation_digest":"sha256:ca489e798ce58c08358a0314e3b6aa3cd123112d64747f9e747094f8fb7ace81","observation_id":"401dede5-edd2-4c5f-b6f7-e5e73976230f","resolution":{"observed_at":"2026-05-15T12:40:00.236337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-13T21:32:09.389485Z","title":"Fine-tuning of continuous-time diffusion models as entropy-regularized control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20455","last_updated":"2026-06-17T19:19:55Z","snapshot_observed_at":"2026-08-16T02:12:38.611765Z","submitted_at":"2026-03-20T19:36:00Z","title":"Time-Reversed BSDEs for Accurate Gradient Estimation in Diffusion Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T21:32:09.389485Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2603.20455"},"observation_digest":"sha256:0f4813702c4d03345411161a664b9164b4534df886b93769b75ccc0ecd3181fc","observation_id":"f7dd87b8-ad4e-45ce-a21a-618e1effffbe","resolution":{"observed_at":"2026-07-13T21:32:09.389485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2604.07427","last_updated":"2026-04-08T17:35:36Z","snapshot_observed_at":"2026-08-12T13:08:00.175370Z","submitted_at":"2026-04-08T17:35:36Z","title":"Personalizing Text-to-Image Generation to Individual Taste","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T18:07:31.236729Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2604.07427"},"observation_digest":"sha256:04aea62db14d682ac82574da66c3a26f7723f9822341f30f2a8de7f8d1a9ebf0","observation_id":"6ec589c5-c8e7-4fd9-93c6-546aeb46e674","resolution":{"observed_at":"2026-05-11T05:30:56.356945Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2604.08580","last_updated":"2026-07-01T19:51:03Z","snapshot_observed_at":"2026-07-13T17:03:24.183921Z","submitted_at":"2026-03-28T13:01:01Z","title":"Adjoint Matching through the Lens of the Stochastic Maximum Principle in Optimal Control","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T22:25:53.037164Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2604.08580"},"observation_digest":"sha256:98b2aa6dbad05e74a95d260a43b70740d1e57b6aec0668bd3d258ecc6ce702ee","observation_id":"17a67241-cc20-4b4f-aee3-e0bb3a319e37","resolution":{"observed_at":"2026-05-14T22:28:04.677525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2604.17415","last_updated":"2026-05-30T13:03:36Z","snapshot_observed_at":"2026-08-16T12:40:33.392205Z","submitted_at":"2026-04-19T12:47:52Z","title":"Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T05:34:01.064008Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2604.17415"},"observation_digest":"sha256:8d0c2e36b3338409870ee9aa00cc71fd9a37a2787f8e6e47eda4388a8b45d877","observation_id":"29ce6258-c0b0-41ed-a3b0-7a0a325a56d6","resolution":{"observed_at":"2026-05-10T05:36:01.639930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2604.17415","last_updated":"2026-05-30T13:03:36Z","snapshot_observed_at":"2026-08-16T12:40:33.392205Z","submitted_at":"2026-04-19T12:47:52Z","title":"Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-05T17:45:49.335925Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2604.17415"},"observation_digest":"sha256:e67a23c85692dad5b4c4f00bdea8594d0e2b1b230aa7f8e072ed49f98fb9e695","observation_id":"09fd1282-ee7d-464f-93ab-ce6e6fee9f8c","resolution":{"observed_at":"2026-07-05T17:51:14.859579Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2604.21641","last_updated":"2026-04-23T12:56:06Z","snapshot_observed_at":"2026-08-15T17:13:16.288850Z","submitted_at":"2026-04-23T12:56:06Z","title":"Robust mean field control: stochastic maximum principle and variational mean field games","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-09T21:18:36.137686Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2604.21641"},"observation_digest":"sha256:34f6c17d09ade469a914e47cd2bdbf82774a2def57984de15e5ccc77ff0d6909","observation_id":"86c8ef6d-c7d3-4a90-a9a2-ab740ae5e5e9","resolution":{"observed_at":"2026-05-11T14:41:13.084308Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2604.27147","last_updated":"2026-06-02T08:50:59Z","snapshot_observed_at":"2026-08-02T17:45:20.844823Z","submitted_at":"2026-04-29T19:56:53Z","title":"How to Guide Your Flow: Few-Step Alignment via Flow Map Reward Guidance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T09:24:42.020782Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2604.27147"},"observation_digest":"sha256:a2aa65650ce3ef8794117292b11f0b91173d1b3a60fb8790f835208c84ea640c","observation_id":"1e3f96af-c386-4267-837f-ad7c9c504fa9","resolution":{"observed_at":"2026-05-12T09:46:26.622144Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2604.27147","last_updated":"2026-06-02T08:50:59Z","snapshot_observed_at":"2026-08-02T17:45:20.844823Z","submitted_at":"2026-04-29T19:56:53Z","title":"How to Guide Your Flow: Few-Step Alignment via Flow Map Reward Guidance","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T09:25:19.439423Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2604.27147"},"observation_digest":"sha256:b0d734df5dabd8066e12a5cc70e39cd1d2d3d6cc56c34150396cc1aa32c1631f","observation_id":"59476dde-0abf-4177-af80-9c8e3b42024c","resolution":{"observed_at":"2026-05-21T09:29:57.139302Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2604.27147","last_updated":"2026-06-02T08:50:59Z","snapshot_observed_at":"2026-08-02T17:45:20.844823Z","submitted_at":"2026-04-29T19:56:53Z","title":"How to Guide Your Flow: Few-Step Alignment via Flow Map Reward Guidance","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-01T08:19:37.044714Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2604.27147"},"observation_digest":"sha256:f88356dc4fa029cbea47e0098ebd3d450c7703d5c19898ded01bcf4d5bd8619e","observation_id":"9f6542dc-4681-4799-a8f7-5dca9d66937a","resolution":{"observed_at":"2026-07-01T08:25:33.209884Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2605.00229","last_updated":"2026-04-30T21:06:46Z","snapshot_observed_at":"2026-07-06T23:13:42.661364Z","submitted_at":"2026-04-30T21:06:46Z","title":"A unified perspective on fine-tuning and sampling with diffusion and flow models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-09T19:43:42.331642Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2605.00229"},"observation_digest":"sha256:d0cd6122b6df4facd1893dde7a2d356008883303b2fedb9c0f84b0d9a672af08","observation_id":"74f21517-faa7-4c4a-99e4-2cc33ba0fee6","resolution":{"observed_at":"2026-05-11T15:31:21.417360Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2605.06583","last_updated":"2026-05-07T17:12:47Z","snapshot_observed_at":"2026-08-11T08:04:18.772776Z","submitted_at":"2026-05-07T17:12:47Z","title":"Improved techniques for fine-tuning flow models via adjoint matching: a deterministic control pipeline","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:00.759474Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2605.06583"},"observation_digest":"sha256:35b6f8ed4b58ed95d45edc0e19191ef69a72c39e396294352a365b9f0b45d2f4","observation_id":"7e306ff6-adde-4f21-9e3e-0b9f8e892c6b","resolution":{"observed_at":"2026-05-11T20:16:10.708476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2605.10759","last_updated":"2026-05-17T07:26:07Z","snapshot_observed_at":"2026-08-16T13:20:03.702471Z","submitted_at":"2026-05-11T15:56:29Z","title":"Reinforce Adjoint Matching: Scaling RL Post-Training of Diffusion and Flow-Matching Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-12T04:38:05.640892Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2605.10759"},"observation_digest":"sha256:e60e2900a4a0a105e230e74d50b2c59364b2b0676bb249c1f4dcdec20f922da9","observation_id":"fbe9da8e-259f-42e3-a10d-9b7938e6660a","resolution":{"observed_at":"2026-05-12T06:06:24.201086Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2605.10759","last_updated":"2026-05-17T07:26:07Z","snapshot_observed_at":"2026-08-16T13:20:03.702471Z","submitted_at":"2026-05-11T15:56:29Z","title":"Reinforce Adjoint Matching: Scaling RL Post-Training of Diffusion and Flow-Matching Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:45.862340Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2605.10759"},"observation_digest":"sha256:70c072ce1bfd95b91e9c7f9c9cc22e7885275bbb47481e4dd9f0a76ce8087eb6","observation_id":"3579cf01-da84-4905-8f61-d061f622b06c","resolution":{"observed_at":"2026-05-20T22:29:09.773226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2605.11347","last_updated":"2026-05-13T05:43:07Z","snapshot_observed_at":"2026-08-14T10:27:00.604140Z","submitted_at":"2026-05-12T00:05:36Z","title":"Gradient-Free Noise Optimization for Reward Alignment in Generative Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T07:46:36.414833Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2605.11347"},"observation_digest":"sha256:9da58358f9e4fc93930dcc8eaede4de895e0c1a072c621979eb930627b1d6c83","observation_id":"2f5efe89-f464-4dc5-8bf2-043413cbb7c1","resolution":{"observed_at":"2026-05-13T07:47:32.864145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2605.11347","last_updated":"2026-05-13T05:43:07Z","snapshot_observed_at":"2026-08-14T10:27:00.604140Z","submitted_at":"2026-05-12T00:05:36Z","title":"Gradient-Free Noise Optimization for Reward Alignment in Generative Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T21:37:15.137190Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2605.11347"},"observation_digest":"sha256:b40326b6ab6b92ecc576e54e0ed995a89a1a5ec8d61d04ca91c876b0d346feda","observation_id":"0a46762f-9e6e-480b-88d8-c5a376dfb142","resolution":{"observed_at":"2026-05-14T21:38:00.027566Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2605.21661","last_updated":"2026-05-20T19:13:28Z","snapshot_observed_at":"2026-08-18T20:19:56.902298Z","submitted_at":"2026-05-20T19:13:28Z","title":"Hierarchical Variational Policies for Reward-Guided Diffusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T08:47:54.424242Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2605.21661"},"observation_digest":"sha256:3a7c62687dff4b662a178f7d656d41863948acf594a4be8a616ac7f28f4e58ee","observation_id":"e698f53e-9c4b-4d80-9de8-feb31f5d9a0b","resolution":{"observed_at":"2026-05-22T08:51:18.363687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2605.26552","last_updated":"2026-05-27T07:59:16Z","snapshot_observed_at":"2026-08-12T19:19:57.902884Z","submitted_at":"2026-05-26T05:02:49Z","title":"Aligning Few-Step Generative Models by Amortizing Sample-based Variational Inference","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-29T19:17:17.682142Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2605.26552"},"observation_digest":"sha256:4ce071e926617110e5a069791fcead3788ff90bf056cc855c2e406e9f002fdb6","observation_id":"89f458d6-cc83-43e3-985d-e0e1bd574d60","resolution":{"observed_at":"2026-06-29T19:23:54.050604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2605.30991","last_updated":"2026-05-29T08:26:14Z","snapshot_observed_at":"2026-08-07T13:59:06.255867Z","submitted_at":"2026-05-29T08:26:14Z","title":"Parallel Tempering Initial Sampling in Inference-Time Reward Alignment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T23:28:22.532621Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2605.30991"},"observation_digest":"sha256:00745a93460a1bccc0c4ea0e3f0280067336b1e83bc8f67c2276344dd8e578f9","observation_id":"c7e6fda4-6689-4a6f-8883-3345d3d6ee1a","resolution":{"observed_at":"2026-06-28T23:32:47.417469Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2606.00267","last_updated":"2026-05-29T18:57:57Z","snapshot_observed_at":"2026-08-14T05:55:30.847601Z","submitted_at":"2026-05-29T18:57:57Z","title":"StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-28T22:45:58.629263Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2606.00267"},"observation_digest":"sha256:253ea244856bd29917ab3289d519a21fac53adb41cb4d82c6efdd3cee4fe9fa8","observation_id":"9eefbb82-2bb5-407a-8b24-aa3dbf34a86b","resolution":{"observed_at":"2026-07-01T19:25:59.810025Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2606.02884","last_updated":"2026-06-01T20:56:24Z","snapshot_observed_at":"2026-08-12T12:54:11.032065Z","submitted_at":"2026-06-01T20:56:24Z","title":"Are we really tilting? The mechanics of reward guidance in flow and diffusion models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T15:20:52.980868Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2606.02884"},"observation_digest":"sha256:f72d71e8093b6aa8438dce505ecb069be9167d088a5a4f2d32ed5125a984bb6f","observation_id":"155a235e-3a2a-4849-b568-4d9406f251f0","resolution":{"observed_at":"2026-07-01T22:26:18.143061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2606.08015","last_updated":"2026-07-19T14:50:06Z","snapshot_observed_at":"2026-08-02T23:41:02.702950Z","submitted_at":"2026-06-06T07:10:25Z","title":"Q-VGM: Q-Value-Gradient Matching for Off-Policy Reinforcement Learning of Flow-Matching VLA","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T19:57:25.010339Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2606.08015"},"observation_digest":"sha256:6ca520aad493b6d8137db69fe08a8412294b945b1e55870a03bc59b7c9b0a689","observation_id":"4fabda44-c3c2-4bf4-936c-27afac9965cd","resolution":{"observed_at":"2026-07-02T21:07:23.765059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-02T12:13:46.640459Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control.arXiv preprint arXiv:2402.15194, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08015","last_updated":"2026-07-19T14:50:06Z","snapshot_observed_at":"2026-08-02T23:41:02.702950Z","submitted_at":"2026-06-06T07:10:25Z","title":"Q-VGM: Q-Value-Gradient Matching for Off-Policy Reinforcement Learning of Flow-Matching VLA","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T12:13:46.640459Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2606.08015"},"observation_digest":"sha256:0e85d354db2673fef569c087095d199c7fa061e43292d469aa46906331d1df61","observation_id":"0ba5ba20-fce8-46aa-bc38-e03ef02b6d33","resolution":{"observed_at":"2026-08-02T12:13:46.640459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2606.22652","last_updated":"2026-06-21T19:56:56Z","snapshot_observed_at":"2026-08-02T01:40:44.031955Z","submitted_at":"2026-06-21T19:56:56Z","title":"A Markov Chain Approach to Preference Alignment","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-26T10:35:25.956748Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2606.22652"},"observation_digest":"sha256:35d8893c89876a3fb5e8368b0e4ec7d6a7530a3a7aea01071171d3f179d3c6e8","observation_id":"b667e3bc-eb4c-4598-adde-fde60c3a68ba","resolution":{"observed_at":"2026-07-04T09:09:42.549353Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2607.00486","last_updated":"2026-07-01T06:14:22Z","snapshot_observed_at":"2026-08-17T11:24:01.268165Z","submitted_at":"2026-07-01T06:14:22Z","title":"PAPA: Online Personalized Active Preference Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-02T16:16:48.255987Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2607.00486"},"observation_digest":"sha256:f70e893e714661f225893ac99a7531706ec3ab0954f06df9f3860ef54e8098e3","observation_id":"0daedf99-a810-47f8-aab7-dcf39f0531db","resolution":{"observed_at":"2026-07-02T16:17:08.251214Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-12T06:44:20.438683Z","title":"Diamant, Alex M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02834","last_updated":"2026-07-03T00:06:31Z","snapshot_observed_at":"2026-08-16T20:33:56.104879Z","submitted_at":"2026-07-03T00:06:31Z","title":"On the Design Space of Discrete Diffusion Online Adaptation for Molecular Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T06:44:20.438683Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2607.02834"},"observation_digest":"sha256:435adfff148a3effe2289be936d0be7cc7d235f9de276b2744d3d3f593b8aa26","observation_id":"5315abf4-931b-4707-9087-b41ea4a3e38d","resolution":{"observed_at":"2026-07-12T06:44:20.438683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":"2402.15194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-08T06:14:38.555744Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control","venue":"cs.LG","work_id":"cab1ecfb-d2c4-4240-8a75-c53b3659f86f","year":2024},"citing_paper":{"arxiv_id":"2607.06432","last_updated":"2026-07-07T15:59:59Z","snapshot_observed_at":"2026-08-19T01:06:16.758927Z","submitted_at":"2026-07-07T15:59:59Z","title":"TILDE: TILt-based Distributional Erasure for Concept Unlearning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-08T06:06:17.561206Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2607.06432"},"observation_digest":"sha256:16474fba2254a3b58245bdf883c0796a4076a8ee6e682b1820e0c79e73adca0e","observation_id":"7e89d0cb-d1f6-47be-a6c6-68769884910b","resolution":{"observed_at":"2026-07-08T06:14:38.557174Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-07-14T12:17:04.321971Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10369","last_updated":"2026-07-11T15:45:12Z","snapshot_observed_at":"2026-08-14T12:47:06.574295Z","submitted_at":"2026-07-11T15:45:12Z","title":"VINE: Taming Generative Control Policies for Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-14T12:17:04.321971Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2607.10369"},"observation_digest":"sha256:784b661cc0bed5cf934dd8ddc6bd26357553da6bf97bc9b86ba221877362e339","observation_id":"3be2a054-2ad4-4cfa-a279-26e45b44ddbc","resolution":{"observed_at":"2026-07-14T12:17:04.321971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-02T09:47:35.240059Z","title":"Fine- tuning of continuous-time diffusion models as entropy-regularized control.arXiv preprint arXiv:2402.15194, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22660","last_updated":"2026-06-28T09:24:19Z","snapshot_observed_at":"2026-08-17T22:33:09.716985Z","submitted_at":"2026-06-28T09:24:19Z","title":"Generalized Fine-Tuning of Diffusion Models via Stochastic Control and FBSDEs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:35.240059Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2607.22660"},"observation_digest":"sha256:457f2f1ff325b9b8e6e151f643c9dab7f40a4a96d9ed9c34e9bcb287a15d1b04","observation_id":"149ddf87-0428-43ff-96c4-425d309ca0f2","resolution":{"observed_at":"2026-08-02T09:47:35.240059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-10T04:23:54.840347Z","title":"Fine- tuning of continuous-time diffusion models as entropy- regularized control.arXiv preprint arXiv:2402.15194, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06582","last_updated":"2026-08-06T20:53:00Z","snapshot_observed_at":"2026-08-18T18:59:20.266118Z","submitted_at":"2026-08-06T20:53:00Z","title":"CrystalGRPO: Target-Aligned and Coverage-Preserving Reinforcement Learning for Flow-Based Crystal Structure Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T04:23:54.840347Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2608.06582"},"observation_digest":"sha256:dbddbd667ccd5eafc84eba61ebee47442aaf360de17c875d308260975f2f66df","observation_id":"16c6db0d-ca04-4022-96b2-351604c17d3c","resolution":{"observed_at":"2026-08-10T04:23:54.840347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.15194/citation-record","integrity":"/paper/2402.15194/integrity","json":"/paper/2402.15194/citation-record.json","paper":"/paper/2402.15194"},"outbound":[],"paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T20:42:44.730597Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 58 inbound Pith citation observations for arXiv:2402.15194."}