{"as_of":"2026-08-13T06:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ef269f4f1b4acf3cc2cc42fa9dd28a0b20bb3b2f49615a7ca40b5303bc9f6bd6","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:54:02.564230Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T18:18:46.456767Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T18:23:50.834907Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"cited_work":{"arxiv_id":"2411.14871","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.14871","snapshot_observed_at":"2026-06-29T18:23:50.834907Z","title":"Prioritize denois- ing steps on diffusion model preference alignment via explicit denoised distribution estimation.arXiv preprint arXiv:2411.14871","venue":null,"work_id":"de15bdee-61a4-4a62-acdb-b22e6f2bcb7e","year":2024},"citing_paper":{"arxiv_id":"2605.09433","last_updated":"2026-05-10T09:13:40Z","snapshot_observed_at":"2026-08-11T04:18:07.585560Z","submitted_at":"2026-05-10T09:13:40Z","title":"Offline Preference Optimization for Rectified Flow with Noise-Tracked Pairs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T02:10:27.595446Z"},"links":{"cited_paper":"/paper/2411.14871","citing_paper":"/paper/2605.09433"},"observation_digest":"sha256:1ad371d5a8fac18827aa30354197cda6168cbb8456b1ff2451d9ed3a8c90233f","observation_id":"129b5c4a-d693-4153-bdd2-f3a363f0aa61","resolution":{"observed_at":"2026-05-12T02:11:15.491627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"cited_work":{"arxiv_id":"2411.14871","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.14871","snapshot_observed_at":"2026-06-29T18:23:50.834907Z","title":"Prioritize denois- ing steps on diffusion model preference alignment via explicit denoised distribution estimation.arXiv preprint arXiv:2411.14871","venue":null,"work_id":"de15bdee-61a4-4a62-acdb-b22e6f2bcb7e","year":2024},"citing_paper":{"arxiv_id":"2605.27736","last_updated":"2026-05-26T22:20:51Z","snapshot_observed_at":"2026-08-02T16:25:15.479630Z","submitted_at":"2026-05-26T22:20:51Z","title":"Explicit Critic Guidance for Aligning Diffusion Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-29T18:18:46.456767Z"},"links":{"cited_paper":"/paper/2411.14871","citing_paper":"/paper/2605.27736"},"observation_digest":"sha256:5a10af258318c318e7ca615ae659961ca6e7fac37d037cd3b5b5a7e8c65343f7","observation_id":"794a93ca-94ab-4678-b4fc-017d4e8955e6","resolution":{"observed_at":"2026-06-29T18:23:50.836500Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.14871/citation-record","integrity":"/paper/2411.14871/integrity","json":"/paper/2411.14871/citation-record.json","paper":"/paper/2411.14871"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.357366Z","title":"Direct preference optimization with an offset","venue":null,"work_id":"f7b7e8d8-5459-4287-a385-4c0a33035016","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.328719Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:fccfb82aee3adbb31806297e7b0882dfb55ae92a7b4c061072463c7c4eefe23b","observation_id":"22725af1-acb7-4d2d-a6fd-c89201d470d2","resolution":{"observed_at":"2026-08-12T14:54:03.361116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.345370Z","title":"A general theoretical paradigm to understand learning from human prefer- ences","venue":null,"work_id":"52388a0c-0062-4583-b866-5849b65527c3","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.333011Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:0369bb09c1d2688c5079b4cafbe20da0ace8d90fd8b3c6d6e7bd6ab10e9342c6","observation_id":"758c0570-25e7-4605-b00b-594ec78088a3","resolution":{"observed_at":"2026-08-12T14:54:03.349920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17956","last_updated":"2025-05-25T15:23:18Z","snapshot_observed_at":"2026-08-12T23:56:22.865279Z","submitted_at":"2024-05-28T08:35:48Z","title":"Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17956","snapshot_observed_at":"2026-08-12T14:54:02.336960Z","title":"Hybrid preference optimization: Augmenting di- rect preference optimization with auxiliary objectives","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.336960Z"},"links":{"cited_paper":"/paper/2405.17956","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:46f6fa9e6fff38d68f9d1e18259acc47e92cfd4bc554fcbcf2fddd01d8ef76fb","observation_id":"782e039f-5c30-418e-8e6a-d57dbd4ec1ab","resolution":{"observed_at":"2026-08-12T14:54:02.336960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.334050Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":"e3b407b9-4a76-4df6-a3d1-0905e54bf94a","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.341510Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:1ac0566401fff25b8b799af7f29544c5b8b126fb5ebdfbb6d10b52e2e4336d51","observation_id":"2b999349-b618-4dcf-aa84-00c42f6e70ad","resolution":{"observed_at":"2026-08-12T14:54:03.337692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.323766Z","title":"Align your latents: High-resolution video syn- thesis with latent diffusion models","venue":null,"work_id":"d458be26-7741-4c34-a6c9-686492d18f0e","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.345351Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:a2b519027d65faa5121416cb2394be9f0e7217fd75cbea8d9467e5f8770a62dd","observation_id":"a2d26ae7-6a78-43e0-9af1-c9c96ac649ba","resolution":{"observed_at":"2026-08-12T14:54:03.327456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.313313Z","title":"Kwok, Ping Luo, Huchuan Lu, and Zhenguo Li","venue":null,"work_id":"b45999fd-c946-4cdb-b6ff-73bd4acdedbf","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.349389Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:a44e8de1342914aa391cfaad03ed8b1d3a6679c9bb5b9777f0c46f8cd472a4f2","observation_id":"b024a3bf-2de2-4a2f-a352-6998ee14252e","resolution":{"observed_at":"2026-08-12T14:54:03.316856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.303160Z","title":"Self-play fine-tuning converts weak language models to strong language models","venue":null,"work_id":"8b92cc44-5d00-47d7-9257-ff5d0ea7ac61","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.353167Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:3699bfc42bb3405a83e6c805117778a7d38fb7a5c7d506a9e857fce891db5ec9","observation_id":"977027d9-7eb1-4016-957b-b518703b7e01","resolution":{"observed_at":"2026-08-12T14:54:03.306807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.292048Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":"8eec6b2e-4092-4d6e-8f72-4bdd9ab182b4","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.357155Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:7490ebcee66f722a0cf56b25c41cb053baa341fdbb32b807f5153bccaec7e99d","observation_id":"bac95065-43eb-497d-8324-21ca538c3fcd","resolution":{"observed_at":"2026-08-12T14:54:03.296275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.281113Z","title":"Diffu- sion models beat gans on image synthesis","venue":null,"work_id":"9ec30fe5-271a-4284-b21d-44e13ffc31fb","year":2021},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.360853Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:233f108e3dc0a57aa47835b975bf9d9bdbf98e0207c9c1185b415820f7e703bf","observation_id":"0ec493cb-2a78-4ba7-b681-a34471d88dec","resolution":{"observed_at":"2026-08-12T14:54:03.284796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.269856Z","title":"Scaling rectified flow transformers for high- resolution image synthesis","venue":null,"work_id":"2650e26a-a531-497a-af97-82fc1ce98c29","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.364610Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:2ad000bb4c1751332d040eb5ec071d1127ad2c67b6f7fd1e1174d2d0660616d8","observation_id":"f928534c-1c43-4ec2-864a-e6c50512e18e","resolution":{"observed_at":"2026-08-12T14:54:03.273670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-08-12T21:18:02.964833Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-12T14:54:02.368175Z","title":"KTO: model align- ment as prospect theoretic optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.368175Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:051b99ba3fe4caa29d6f161183e94b8a23aa63fde7570bad268afb5738d1657c","observation_id":"36ffea07-be43-4871-96e4-e8a918ea1218","resolution":{"observed_at":"2026-08-12T14:54:02.368175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.257456Z","title":"DPOK: reinforcement learning for fine-tuning text-to-image diffusion models","venue":null,"work_id":"6da004c1-47fa-46b4-ae1b-ce1401d1c593","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.372209Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:7383cfe1826f2ead5e57d9ef4346b38083858b03e923c7a44c2742eb7a139506","observation_id":"fbf4ed89-55b6-4bb7-ae79-6042745a5556","resolution":{"observed_at":"2026-08-12T14:54:03.262275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.246729Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":"49f96d01-2ed7-4190-b6e6-d8a1136a36cd","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.375831Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d7cbcb6026be01fc0435e5bca873e208a6220b1250deb4b77586adcfd977a5ec","observation_id":"4dd6b9a1-9c3f-448c-b2d1-a494f4c22d5f","resolution":{"observed_at":"2026-08-12T14:54:03.250381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.234970Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"d294bca0-1ec0-4bc4-b98c-99173efcef0a","year":2018},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.379462Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:9f7b22630cc3b7fd4d38f607d587715cf309e547fb74e5fc48f52e4f72258235","observation_id":"f405a09f-a8b8-4f0c-b4f1-24aedc49ec4e","resolution":{"observed_at":"2026-08-12T14:54:03.239054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.220880Z","title":"Brandt, and Tomer Michaeli","venue":null,"work_id":"c6f1c3d5-4b10-463c-9007-23676779dfff","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.382998Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:fa09839c2def65d488f1bb7268a02eed686a1ea150fb1dda9b2445cb6f3cc9ba","observation_id":"f5386393-9f77-45d0-a062-e91a442a7eaa","resolution":{"observed_at":"2026-08-12T14:54:03.225438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.208945Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"be094e1b-1edd-416c-8399-9fb72f33c9dc","year":2020},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.386341Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:460735a947528f092159dad4013986f05e2e44b521c1062422cec6214d330457","observation_id":"0fd283bb-8947-4ec0-a147-71c10288706d","resolution":{"observed_at":"2026-08-12T14:54:03.212698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.197434Z","title":"Estimation of non-normalized statis- tical models by score matching","venue":null,"work_id":"a16dae4c-0bee-4e25-9c4f-426ca666cd6b","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.389563Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:2af33e7f25a67ce8fe09488d1e2ace3b45b25ebf53501cdc4844dc2e10d75e01","observation_id":"7ed99fb3-f4b9-4cb6-b824-6b90756f9817","resolution":{"observed_at":"2026-08-12T14:54:03.201515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.186396Z","title":"Reward learning from human preferences and demonstrations in atari","venue":null,"work_id":"a6a68606-e05c-49b5-8f91-21f1712c946f","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.393106Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:955d478f6a2a111497b0cd166f4a0c1d9bf3d47b75d859946a9f62bcb2bfbac7","observation_id":"056ea50f-2def-42a5-b416-ba63338c3fbf","resolution":{"observed_at":"2026-08-12T14:54:03.190321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.175048Z","title":"Ryzhakov, Andrei Chertkov, and Ivan V","venue":null,"work_id":"bf34a595-d134-4beb-bcbd-579630dfb960","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.396691Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:0fc813acbdadb706c54b0c154f0a075121a92ea49d679f91dadc439310b5412b","observation_id":"7cde6093-e2e3-4bba-999e-833d799616a2","resolution":{"observed_at":"2026-08-12T14:54:03.178944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.162918Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"79b93ed6-fdb7-4060-92d4-0e3c5c39f5af","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.400628Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:b58d3ff26f5fbf8900d102bc4be9f890902a82951bf720147f8eb8410288c7ee","observation_id":"aecd68b4-bbf9-4011-8345-bf2be980306c","resolution":{"observed_at":"2026-08-12T14:54:03.167644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.151662Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"fcd7fb1d-6bb9-4a09-b3b9-b7b0e67349ba","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.404196Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:b80f59c6392bfc801ff6d896f06774d81e558fbe419d9c5c3bd1dcbaac262cd0","observation_id":"3832647f-04d5-48aa-aa2f-e45e5d773dd8","resolution":{"observed_at":"2026-08-12T14:54:03.155479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.140957Z","title":"Bradley Knox and Peter Stone","venue":null,"work_id":"cfa5c999-5fae-44b2-93cb-05b28f04de49","year":2009},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.408019Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:a19d87c28bd2436dfc95e06544fc6f59aef29f4edc298ea2bb4378133dc41d1b","observation_id":"b884d6d8-9432-4400-bca9-162639bd102b","resolution":{"observed_at":"2026-08-12T14:54:03.144654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.130097Z","title":"Dif- fusion models already have A semantic latent space","venue":null,"work_id":"b6ffd0f3-ae3d-483e-ab82-a0859628fbc0","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.411697Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:43722005afc293230b63d4524a59fe4c956791aa391e377a33c5e1c7bb0d3dc0","observation_id":"590c7101-782e-441d-a9f4-6deb5e9fec30","resolution":{"observed_at":"2026-08-12T14:54:03.133590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04465","last_updated":"2024-10-11T19:43:11Z","snapshot_observed_at":"2026-08-13T00:36:44.636118Z","submitted_at":"2024-04-06T01:23:23Z","title":"Aligning Diffusion Models by Optimizing Human Utility","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04465","snapshot_observed_at":"2026-08-12T14:54:02.415254Z","title":"Aligning diffusion models by optimizing human utility","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.415254Z"},"links":{"cited_paper":"/paper/2404.04465","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:4fa19528731a1769def0ad71132ca8292f88961e34c534b36d79b08a43472de1","observation_id":"b436b6c6-7288-4fef-ba06-b6de3f4005e6","resolution":{"observed_at":"2026-08-12T14:54:02.415254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-12T23:48:30.414248Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-12T14:54:02.419272Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.419272Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:7a3cf630f12d3ceea8bad62f60e4af94e90843dc60abab76f6fbab26eeb27e3b","observation_id":"c77e5e8a-10a2-4e8d-ad7e-01794de62aae","resolution":{"observed_at":"2026-08-12T14:54:02.419272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.120055Z","title":"Let’s verify step by step","venue":null,"work_id":"cab51ed1-799f-4cac-a8ea-a771e9c71162","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.423053Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d5e7c3ba9e66e3baca2ca516350b513ef0161b85c4a91664c5b1fbfc06c39aff","observation_id":"7c60fc4c-8778-483e-bb79-a872fd7fb5c3","resolution":{"observed_at":"2026-08-12T14:54:03.123512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.108979Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":"561f88f1-9237-4c36-998b-c47fb81ac32f","year":2016},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.426479Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:2745822312d653b2942af512a63371f99227036b0558e4989d896c7cb8859ab9","observation_id":"78f53924-dca5-4739-b167-d2751c617350","resolution":{"observed_at":"2026-08-12T14:54:03.113164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.430101Z","title":"Alignment of diffusion models: Fun- damentals, challenges, and future","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.430101Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:0a6e08058a91d07e8f276f649043e71744a6734931750bb4575d6c6e0afc7c07","observation_id":"77126f30-7f1f-424c-8a20-51262ab6e257","resolution":{"observed_at":"2026-08-12T14:54:02.430101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.097837Z","title":"Interpretation and generalization of score matching","venue":null,"work_id":"632ddb77-125a-4885-b591-e83f581bdfed","year":2009},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.433620Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d27e3f3a808ccd07ba8795a064a7182a5cdf797ddd78750375100c41730349c4","observation_id":"bb3b29a4-363d-41e5-a3be-f53fd5a16684","resolution":{"observed_at":"2026-08-12T14:54:03.101748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.085990Z","title":"Ho, Robert Tyler Loftin, Bei Peng, Guan Wang, David L","venue":null,"work_id":"5a64b624-d75c-4a67-95cb-16bb678852a2","year":2017},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.437239Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:0dbeb0b7f1d4119ec8a9e886d649ea962047a76f284e4dc52ff03e1cf5382215","observation_id":"e39b0d5b-9dfe-46f8-9c06-104af849cfbf","resolution":{"observed_at":"2026-08-12T14:54:03.090375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.074320Z","title":"Simpo: Simple preference optimization with a reference-free reward","venue":null,"work_id":"84de6106-89a4-4066-a866-06d969855a68","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.441028Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:029bdbb0c0ea292d870be01bc24fde09105a0fe400190091e65ba0d9011034a0","observation_id":"e95140c4-4e3a-4518-8ae4-c28102384ea7","resolution":{"observed_at":"2026-08-12T14:54:03.078511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-12T14:28:10.961989Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-12T14:54:02.444437Z","title":"Riedmiller","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.444437Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:72591332f1466a439378640f47ff1979b422d2591bf428f0ee13f023dc8a7031","observation_id":"200028e2-5bd6-4e26-bcfc-ac7eedcff526","resolution":{"observed_at":"2026-08-12T14:54:02.444437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.062568Z","title":"Lillicrap, Tim Harley, David Silver, and Koray Kavukcuoglu","venue":null,"work_id":"2b1351d3-27cd-4e43-8bdf-d2c5187745e6","year":2016},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.448722Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:f7d9a3c63527992764eb2a5cf6774fac5fe5426b7d2ee84c12d6c70c08411e5a","observation_id":"ca13e3af-9670-479c-9189-6df280cc26ba","resolution":{"observed_at":"2026-08-12T14:54:03.066456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.050309Z","title":null,"venue":null,"work_id":"6e62987b-aa5d-4810-a4db-a45a47ba5299","year":2022},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.452354Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:dca6facc9d0f0a7438ccd23a7025fdcaef06b278e3040c432235ccd0e2885bc7","observation_id":"45738fa3-cb80-498a-9e4b-6e39974ca1fc","resolution":{"observed_at":"2026-08-12T14:54:03.054846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-12T14:54:02.456141Z","title":"Sdxl: Improving latent diffu- sion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.456141Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:68bed473dfc609d925d4d54633ce76f4bbbd569018529f7b0da0e5d374661733","observation_id":"26eb8468-259e-4d7e-9703-d63950bece0a","resolution":{"observed_at":"2026-08-12T14:54:02.456141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.037812Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"d8faa775-1270-4628-b0db-bc0f3594bec7","year":2021},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.460432Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:616cef807de49af394ef6e538ebe33baacb1a18d535a6271fc1bf5cc4e80f51c","observation_id":"cd834621-b559-4394-b718-9ad409ca307c","resolution":{"observed_at":"2026-08-12T14:54:03.042107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.026920Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":"aa2a28c6-07f2-4011-972f-9a32db466652","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.464075Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:b4ba37565a43cd9fa94cbe991d6e63085d2acc07b39862f884f87ae6b1d80dcf","observation_id":"c30638c4-523f-41f1-b562-b0ab06fb12a4","resolution":{"observed_at":"2026-08-12T14:54:03.030862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.015800Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"5e7c0baa-0b1c-4041-b399-a38471d41d84","year":2022},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.467621Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:76d90738733580d75ea5f1ba7a00a9ac89bb53e444057d473668dad11be1eaed","observation_id":"9087a192-90d2-47f3-8c34-8827eff92f0f","resolution":{"observed_at":"2026-08-12T14:54:03.019811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03715","last_updated":"2024-04-04T17:56:41Z","snapshot_observed_at":"2026-08-13T00:37:30.992108Z","submitted_at":"2024-04-04T17:56:41Z","title":"Direct Nash Optimization: Teaching Language Models to Self-Improve with General Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03715","snapshot_observed_at":"2026-08-12T14:54:02.471071Z","title":"Direct nash optimization: Teaching language models to self-improve with general preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.471071Z"},"links":{"cited_paper":"/paper/2404.03715","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:2e8fa910c9c16d5c4aa8fcd5b6dded4bc18a62a48c14cf71390cc07f0702a3e0","observation_id":"62b9beb5-4704-4174-b168-8ce82ef453e4","resolution":{"observed_at":"2026-08-12T14:54:02.471071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.004209Z","title":"Jordan, and Philipp Moritz","venue":null,"work_id":"c38cffbd-44de-4408-8081-7f7b8e6d4103","year":2015},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.475762Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:67acffd6a24fa51a91e1aa74b71551903c7cd8e9a110fc4555411629d52b4eaf","observation_id":"e5f3d85d-3c8b-4930-b489-719eb29f2f50","resolution":{"observed_at":"2026-08-12T14:54:03.007942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T14:54:02.479171Z","title":"Proximal policy optimiza- tion algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.479171Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:55ad0671eb4cf8527e4d8b1a1831a1485d66efcba8f581f3094a7144268150a9","observation_id":"ea3662ea-bf7e-4387-9349-092eefed81cc","resolution":{"observed_at":"2026-08-12T14:54:02.479171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.993649Z","title":"Denoising diffusion models on model-based latent space","venue":null,"work_id":"2ec023ea-7ca2-4bf9-b676-f7ad39ca2db3","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.483369Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:bcaf0f84b8f4a0cc6787698c2840b732dfeef0668cb6854f467a0e8119f1936c","observation_id":"65a1d783-c4c5-4063-be56-8316d973431f","resolution":{"observed_at":"2026-08-12T14:54:02.997501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.980791Z","title":"Riedmiller","venue":null,"work_id":"af54bfcc-780a-441e-827c-c9e8c7bdd513","year":2014},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.486970Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:e0e5878fce8b97b67bc6e57ed7aa650c64ebc430bfc228ea9e8e522dba389435","observation_id":"65bb36dc-fe03-4a92-b4c8-cc40f26a37e0","resolution":{"observed_at":"2026-08-12T14:54:02.985577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.967729Z","title":"Weiss, Niru Mah- eswaranathan, and Surya Ganguli","venue":null,"work_id":"b7782cc6-8db7-46a8-bac5-cb5bf2ce794e","year":2015},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.490776Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:88c6c8c32b29578de63d36da073ea3b19fc3ec8327842febf349abb37a3a6236","observation_id":"f3d2bf19-de5e-4fd2-bc05-c103e2f9413d","resolution":{"observed_at":"2026-08-12T14:54:02.974017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.957004Z","title":"Prefer- ence ranking optimization for human alignment","venue":null,"work_id":"4f2fee34-7d46-4a2a-a613-7969be4634d7","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.494331Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:7c7d41e5c57273275ccc5526aa523243af6299b1bf73ba0b72dcf1bd06d54e92","observation_id":"dbf00f3e-f92a-4071-b3ad-45c6f05b7845","resolution":{"observed_at":"2026-08-12T14:54:02.960541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.946360Z","title":"De- noising diffusion implicit models","venue":null,"work_id":"3b15be80-40f8-4494-85f9-f4dd28225782","year":2021},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.497907Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:fa8dbc8251361887c0b2d0b41e86999844c1c6e371ca78c72d67ffccf26e36a1","observation_id":"74007324-9572-4c4a-a723-9014230ea04b","resolution":{"observed_at":"2026-08-12T14:54:02.949774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.936403Z","title":"Kingma, Abhishek Kumar, Stefano Ermon, and Ben Poole","venue":null,"work_id":"281a1954-4b21-4425-b35f-32db9e029276","year":2021},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.501599Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:a7ba35ede3e1c62e82dc75707b41c41cbb07f44b948dfb1b7d9cbc87bacb8c48","observation_id":"699b4337-a8ff-4baf-a400-5005f27dd5da","resolution":{"observed_at":"2026-08-12T14:54:02.939942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.925867Z","title":"Ziegler, Ryan Lowe, Chelsea V oss, Alec Radford, Dario Amodei, and Paul F","venue":null,"work_id":"57e3638f-b3e0-43fe-8e42-c4f32f9bfd80","year":2020},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.505121Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:4aa93b89f12d2d27e73c0ec9ca075c913be921d9400f1468627997a93926bf35","observation_id":"e71875a0-0ec2-4b2c-b1c2-4c31cca034d3","resolution":{"observed_at":"2026-08-12T14:54:02.929645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.915116Z","title":"Sutton and Andrew G","venue":null,"work_id":"9b6b6d8a-14c3-4ffa-94ef-681634983c63","year":1998},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.508614Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:b95c21eae79c296fbf0018b804f88bf011bf9ec36abd410da18ff3a08aced614","observation_id":"9f894b4a-0b23-46ff-80dc-3688956261a3","resolution":{"observed_at":"2026-08-12T14:54:02.918825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.904322Z","title":"A connection between score matching and denoising autoencoders","venue":null,"work_id":"07e66f93-7f2f-4048-8e2f-c448c0722556","year":2011},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.512300Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:0f11dd44b4f4ae364097955d820a118ffd996282fd9dd3322985875f9a0f2af2","observation_id":"b0ffe050-9b4a-4c6f-8e4d-36a5a2812329","resolution":{"observed_at":"2026-08-12T14:54:02.907950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.893693Z","title":"Diffusion model alignment using direct preference op- timization","venue":null,"work_id":"db5018b3-7d93-4b84-8018-b3fe0f03c825","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.516015Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d3d2372cdbb9542e0053691e11967c20a7f28d6c4f133b4a94d45c00684d257b","observation_id":"00ec18d6-3d41-43a9-ba98-3860f67799ff","resolution":{"observed_at":"2026-08-12T14:54:02.897621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-08-11T19:09:11.098841Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-12T14:54:02.519982Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.519982Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:af33d3deb156f37b200e6fc03ed0c19ccc4fbacdbe76ee3e3e9be7fb391fccd9","observation_id":"43d4b163-c4ba-45ed-beb8-06a5d4369a6a","resolution":{"observed_at":"2026-08-12T14:54:02.519982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.882844Z","title":"Dueling network architectures for deep reinforcement learning","venue":null,"work_id":"6eb2103a-4166-41a3-979b-7edebc2be9d0","year":2016},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.523781Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:69748f704683e83c6ad7a5705d1575518d7bc8906b82805e56128ff088ada745","observation_id":"a8a6af0c-b7eb-4f3c-9282-bd5bd90e023e","resolution":{"observed_at":"2026-08-12T14:54:02.886959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.872162Z","title":"Waytowich, Vernon Lawh- ern, and Peter Stone","venue":null,"work_id":"fa6bb08e-c773-4f56-bbb2-01cc3ba7996f","year":2018},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.527351Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:079b519fa1686f4938b8363fa7d1d2db048aa213e2d80c01979dad22a6c77250","observation_id":"fae401ae-e706-462a-83c9-3e53b52aba3a","resolution":{"observed_at":"2026-08-12T14:54:02.875924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.861091Z","title":"β-dpo: Direct preference optimization with dynamic β","venue":null,"work_id":"3a0b2c37-0cbc-4271-88c5-ab2e90e028c1","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.531043Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:ab39d935b716533979688e6f0f5d77735c6d0ebf05119fb3b106d3a908edee01","observation_id":"17af7ddc-68cc-48ca-a6e1-43804bed4ab4","resolution":{"observed_at":"2026-08-12T14:54:02.864885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-11T00:30:13.593181Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-12T14:54:02.534776Z","title":"Human pref- erence score v2: A solid benchmark for evaluating human preferences of text-to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.534776Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:bc5110838f1cb2a6609ee76277d135e96965d38e7a7d1eb394c3471b7d40411a","observation_id":"ed101848-77b0-44db-a3fb-01f7ef36eb0c","resolution":{"observed_at":"2026-08-12T14:54:02.534776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.849916Z","title":"Using human feedback to fine-tune diffusion models without any reward model","venue":null,"work_id":"adfe4859-3ed2-4d11-aff2-9ae92c90fd58","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.538484Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:6392dd98d5c0047498063de0731556bf92620c838febafba7dd3bfcac9adff51","observation_id":"5cef9c92-4497-4018-9253-8d9bfb2eb68d","resolution":{"observed_at":"2026-08-12T14:54:02.853808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.837761Z","title":"Diffusion models: A comprehen- sive survey of methods and applications","venue":null,"work_id":"f6f86f15-5374-46f1-b59b-e9847637468f","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.541992Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:7302b0894b5ee5f8ec4dd9feab767b4c393d355ec13d3e2a801baa0d242f1b7b","observation_id":"53cef9b3-aff9-4609-86b0-0d88016a0b12","resolution":{"observed_at":"2026-08-12T14:54:02.841657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.826500Z","title":"A dense reward view on aligning text-to-image diffusion with preference","venue":null,"work_id":"8b71f193-b3d9-47dc-af97-83fda606b44a","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.545504Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:af4d7190435362d7bb194333a300b46d91a260819bcc6442f8ca9e0eb5a32f31","observation_id":"8b9fbbf3-1f98-450b-9fd6-2178a3f15a72","resolution":{"observed_at":"2026-08-12T14:54:02.830317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-12T18:27:33.686313Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-12T14:54:02.549137Z","title":"RRHF: rank re- sponses to align language models with human feedback without tears","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.549137Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d915e10b899ad9cec601ced1a41296ed61a9b704e98cf686b520e4a1ba5dca77","observation_id":"c2b5b6be-1713-44b7-9968-af7c7e415bc3","resolution":{"observed_at":"2026-08-12T14:54:02.549137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-11T04:34:07.318549Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-12T14:54:02.552889Z","title":"Ziegler, Nisan Stiennon, Jeffrey Wu, Tom B","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.552889Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:becc5c4d1f943a0ecffb35797bd7e95512935dff437263f50a435697f5ac1683","observation_id":"38561138-6703-4579-9d18-eb5170f7a1ef","resolution":{"observed_at":"2026-08-12T14:54:02.552889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.815421Z","title":"Derivation of the Loss Function Defined in Eq","venue":null,"work_id":"774cc2a0-b98a-44a9-8c18-aa8ad6acf5dd","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.556868Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:2ffbddf401ba697ecf997b87909d76ec631928b93f0554d29c065ee72502f972","observation_id":"22bceab4-0537-47e5-bb51-3cae2fefbeb1","resolution":{"observed_at":"2026-08-12T14:54:02.819504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.803292Z","title":null,"venue":null,"work_id":"d1986d98-da9b-4e2d-bf3f-5d5d6306be20","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.560578Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:57fba65b7eebbb3420efac56a25c49d8729a8b23268fce1ea876b707a4be2306","observation_id":"584f6e90-b1a3-4f74-a811-2ac38b14fd7e","resolution":{"observed_at":"2026-08-12T14:54:02.807475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.789679Z","title":"Implementation Details We employ a constant learning rate with a warm-up sched- ule, finalizing at 2.05 × 10−5","venue":null,"work_id":"631745c2-3097-4001-b719-ab218d613269","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.564230Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:e5cb1b1a1371f5455cc27c5b2d9b9704cf9c5b3fe69332c951f26596aba535a6","observation_id":"edc19149-b908-4958-8d5d-9ec5f162aea6","resolution":{"observed_at":"2026-08-12T14:54:02.795707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T04:47:56.523822Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":49},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 2 inbound Pith citation observations for arXiv:2411.14871."}