{"as_of":"2026-08-10T00:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3fedf93466a6ac20e700fcc7fc04f2004466b0023ec02a605374f12e30ec50bc","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:30:42.199545Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.13846/citation-record","integrity":"/paper/2506.13846/integrity","json":"/paper/2506.13846/citation-record.json","paper":"/paper/2506.13846"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:44.597875Z","title":"https://artlist.io/stock-footage/,","venue":null,"work_id":"fc1c961e-0478-4477-9869-c12892ac17cc","year":null},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.549617Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:e651395d7e712b1b6a4da1209f16dbc43e579b0fd5c7ec6b9b15f6096ede68e4","observation_id":"20413fab-71dc-4c20-9fcb-9b49587caf7a","resolution":{"observed_at":"2026-08-07T00:30:44.618967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T00:30:41.563384Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.563384Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:6ae126f7d74a9157b8f1f5a2c01948ec4769220ea5a771c54ac04c669da80a87","observation_id":"ec50d9ff-c2b5-47ea-9971-f675a7d4753b","resolution":{"observed_at":"2026-08-07T00:30:41.563384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.569729Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.569729Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:8fd1cb13bf76f2907e75b4d26a7264efd0f9181cd41b3f734d1f78e0b25b6125","observation_id":"9e6802c0-c2d2-414d-8791-6ae837fbd45d","resolution":{"observed_at":"2026-08-07T00:30:41.569729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17400","last_updated":"2024-06-21T16:45:11Z","snapshot_observed_at":"2026-08-06T10:08:54.816113Z","submitted_at":"2023-09-29T17:01:02Z","title":"Directly Fine-Tuning Diffusion Models on Differentiable Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17400","snapshot_observed_at":"2026-08-07T00:30:41.576540Z","title":"Directly fine-tuning diffusion models on differentiable rewards.arXiv preprint arXiv:2309.17400, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.576540Z"},"links":{"cited_paper":"/paper/2309.17400","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:14335626a58f14ebd90dad976215a9b57e4c3444100c2d69b1bb3602b55cee8f","observation_id":"77e5b4c8-2f55-4213-9291-b61e7abdadcc","resolution":{"observed_at":"2026-08-07T00:30:41.576540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-07T00:30:41.582443Z","title":"Raft: Reward ranked finetuning for generative foundation model alignment.arXiv preprint arXiv:2304.06767, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.582443Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:ac1c89d2498c0cafe6bab29ac8e697835e5e5761aa5d73c67460f88725f44fa7","observation_id":"8d41e7a2-5159-4fe6-91a9-d3370d959521","resolution":{"observed_at":"2026-08-07T00:30:41.582443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.589181Z","title":"Raft: Reward ranked finetuning for generative foundation model alignment, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.589181Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:23655a79702c142888f92abd78a1ae44288b5834b30d45f41e6896413faf4f0a","observation_id":"d5c42280-e86b-4061-b713-2bcf3494bb8a","resolution":{"observed_at":"2026-08-07T00:30:41.589181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13436","last_updated":"2025-03-17T17:58:30Z","snapshot_observed_at":"2026-08-07T16:57:02.267787Z","submitted_at":"2025-03-17T17:58:30Z","title":"Unified Autoregressive Visual Generation and Understanding with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13436","snapshot_observed_at":"2026-08-07T00:30:41.596688Z","title":"Unified autoregressive visual generation and under- standing with continuous tokens.arXiv preprint arXiv:2503.13436, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.596688Z"},"links":{"cited_paper":"/paper/2503.13436","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:21c96ba74c90d70baec090bb19bc2eb21658787404234cbd8eb25ebe6e0a8929","observation_id":"33621fbe-ebb6-43a6-a7a6-bd47ca6318c0","resolution":{"observed_at":"2026-08-07T00:30:41.596688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.604787Z","title":"Dpok: Reinforcement learning for fine-tuning text-to-image diffusion models.Advances in Neural Information Processing Systems, 36:79858–79885, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.604787Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:7780f7dc85261ff0e54394c265f005ac808ca26bdf545f0ca7e06b4c83790598","observation_id":"91b9cc5a-74fc-448c-8a72-3960161cbd4f","resolution":{"observed_at":"2026-08-07T00:30:41.604787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-07T00:30:41.609617Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion.arXiv preprint arXiv:2208.01618, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.609617Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:1217a7459d50946d7daef704d93ef7d928822bbb963a006952116c5b5c501a70","observation_id":"06810d30-f8bb-4baf-a8c5-96bb58b2c623","resolution":{"observed_at":"2026-08-07T00:30:41.609617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.617755Z","title":"Generative adversarial networks.Communications of the ACM, 63(11):139–144, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.617755Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:cfac5b66165890fa9d1d6fbc5c1bdc713bf9b5fc2453ca9a93c87955255b0fc9","observation_id":"c01f7731-5b75-4726-aed6-e909c7427171","resolution":{"observed_at":"2026-08-07T00:30:41.617755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15252","last_updated":"2024-10-14T04:08:53Z","snapshot_observed_at":"2026-07-06T18:34:56.008706Z","submitted_at":"2024-06-21T15:43:46Z","title":"VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15252","snapshot_observed_at":"2026-08-07T00:30:41.631422Z","title":"Videoscore: Building automatic metrics to simulate fine-grained human feedback for video generation.arXiv preprint arXiv:2406.15252, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.631422Z"},"links":{"cited_paper":"/paper/2406.15252","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:bc8812415ce764bde2b63f725471ece213bbf0af387e71571cec63d4656cdc4e","observation_id":"c454e54b-d1bd-49c1-852d-f1b4e5d86501","resolution":{"observed_at":"2026-08-07T00:30:41.631422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19334","last_updated":"2024-06-09T11:34:12Z","snapshot_observed_at":"2026-07-06T18:22:10.094519Z","submitted_at":"2024-05-29T17:59:20Z","title":"LLMs Meet Multimodal Generation and Editing: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19334","snapshot_observed_at":"2026-08-07T00:30:41.640876Z","title":"Llms meet multimodal generation and editing: A survey.arXiv preprint arXiv:2405.19334, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.640876Z"},"links":{"cited_paper":"/paper/2405.19334","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:659262498902e6fee58c69962cff4c38ac3749d15e8e9fcd74063f0483368b43","observation_id":"ffe2e720-7279-41a3-aca9-d66316b083eb","resolution":{"observed_at":"2026-08-07T00:30:41.640876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-07-06T14:22:24.004857Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-07T00:30:41.649009Z","title":"Latent video diffusion models for high-fidelity long video generation.arXiv preprint arXiv:2211.13221, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.649009Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:5f3cbf2119f02109d79781cffe2645d20827cb3eced8294208dfca9d8fec413a","observation_id":"ef9c6891-d867-486b-8dcf-e868be3cd0dd","resolution":{"observed_at":"2026-08-07T00:30:41.649009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-07T00:30:41.658467Z","title":"Clipscore: A reference-free evaluation metric for image captioning.arXiv preprint arXiv:2104.08718, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.658467Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:0296cbf91837018fa7b1485bbebbe221ebb93959733f47fc1acc4e87694995e1","observation_id":"44e67f66-399b-4115-a815-46db95fbe076","resolution":{"observed_at":"2026-08-07T00:30:41.658467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.668004Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.668004Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:6bbf6e7ea31852c94a59b1496c63c44d034de40eeb97d45feadae65c8fbde417","observation_id":"499b0f8e-cc44-49a1-b6e3-6675b4051efb","resolution":{"observed_at":"2026-08-07T00:30:41.668004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.682644Z","title":"Cascaded diffusion models for high fidelity image generation.Journal of Machine Learning Research, 23(47):1–33, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.682644Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:badaf7ee168425b289aa76a377377657461dfd9221389c3e4bca34673c69f397","observation_id":"8bfa17b5-b3d3-4204-918d-dc1414bb07bb","resolution":{"observed_at":"2026-08-07T00:30:41.682644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T00:30:41.695836Z","title":"Classifier-free diffusion guidance.arXiv preprint arXiv:2207.12598, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.695836Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:6ddf35dd084b0fd4da423259ceeadbd1de3022bed46f917cd2e2aa25ea384093","observation_id":"8b83ff48-fc22-4d78-a426-6ec696d792cc","resolution":{"observed_at":"2026-08-07T00:30:41.695836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.703389Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.703389Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:43c24b1e6cfe7da1df7895fb1744e5b8324e0bfab4ede98b263bc4060085a7c4","observation_id":"e4de4576-2f99-4966-bac5-f46c8c4e28f3","resolution":{"observed_at":"2026-08-07T00:30:41.703389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.714974Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation.Advances in Neural Information Processing Systems, 36:36652–36663, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.714974Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:f5e959c4177c74a68192d61943f450ccb478a6f1009cb49712992969862e2b92","observation_id":"512c2fe0-6d9b-4487-89bd-f77f6397c892","resolution":{"observed_at":"2026-08-07T00:30:41.714974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T00:30:41.732787Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.732787Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:70548aa90a5f4af14846438e4b3e02298d608d2df79661d3164e441a44bc4561","observation_id":"6b24c9e4-6286-4d10-bcee-98867a56858d","resolution":{"observed_at":"2026-08-07T00:30:41.732787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-07T00:30:41.748361Z","title":"Aligning text-to-image models using human feedback.arXiv preprint arXiv:2302.12192, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.748361Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:3671c5eb74ba293d26031be882eebe24d97cc2833243cb3470774cb499d85b1b","observation_id":"91e21d63-abe0-4248-b166-9019f197ab21","resolution":{"observed_at":"2026-08-07T00:30:41.748361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.759453Z","title":"Rich human feedback for text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.759453Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:68326f89ad511a970af29c8379bc6b9868072ce7fda0d0490cf8653d4aab4af3","observation_id":"3bb4c1d0-18be-41dd-9422-f793e250c9f4","resolution":{"observed_at":"2026-08-07T00:30:41.759453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-07T00:30:41.767912Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step.arXiv preprint arXiv:2406.04314, 2(3), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.767912Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:8f9afbea48e5c9e9c438be9e2bb9686ada6a5b7144b8a651760c518cfe72b4fc","observation_id":"5ee3f4d7-01c7-4f6d-a7d5-70ed869f45d7","resolution":{"observed_at":"2026-08-07T00:30:41.767912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:44.253075Z","title":"Safetydpo: Scalable safety alignment for text-to-image generation, 2024","venue":null,"work_id":"78ae4657-def6-4605-810d-92ccd1afdce8","year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.775409Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:e783522dadf22d0a9715a96c2a0446516e252a4db0612ff5ff4e9bcef4b130f6","observation_id":"1bc5e73f-9acf-4086-898b-6678cb9090f9","resolution":{"observed_at":"2026-08-07T00:30:44.268984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14167","last_updated":"2024-12-18T18:59:49Z","snapshot_observed_at":"2026-08-09T07:20:53.172443Z","submitted_at":"2024-12-18T18:59:49Z","title":"VideoDPO: Omni-Preference Alignment for Video Diffusion Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14167","snapshot_observed_at":"2026-08-07T00:30:41.785973Z","title":"Videodpo: Omni-preference alignment for video diffusion generation.arXiv preprint arXiv:2412.14167, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.785973Z"},"links":{"cited_paper":"/paper/2412.14167","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:65758e8c967292f70cc5455576a315edb07fb7fef56ff33d4149873fc8a560bc","observation_id":"7c6031e8-3145-4278-8fd3-74cb45b84fcd","resolution":{"observed_at":"2026-08-07T00:30:41.785973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:44.223726Z","title":"Multimodal pragmatic jailbreak on text-to-image models, 2024","venue":null,"work_id":"d73cbf92-1c95-4d47-8eb7-fc55490d4232","year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.796198Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:df4fa074ac443144ae61f5709ce2899368444ff11ad749832d149172ea591021","observation_id":"48343b14-e192-4e52-9086-763dc09b601b","resolution":{"observed_at":"2026-08-07T00:30:44.232921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.815304Z","title":"Evalcrafter: Benchmarking and evaluating large video generation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.815304Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:4cff81936789ea8212b182725e0ae417366906d41f673cee4c4eddd881815e9b","observation_id":"c3a9066b-f0a8-4c49-a581-bc9cf2fc9de7","resolution":{"observed_at":"2026-08-07T00:30:41.815304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.829981Z","title":"Unitok: A unified tokenizer for visual generation and understanding.arXiv preprint arXiv:2502.20321, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.829981Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:6bab1ef9a7f6ac6422dbccc99202a5a7978cfd6b8e3a32b7e7da58d9178a67e8","observation_id":"bb00c7da-bcd8-4ac2-9c17-ca49ef006556","resolution":{"observed_at":"2026-08-07T00:30:41.829981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-07-06T20:22:04.328179Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09732","snapshot_observed_at":"2026-08-07T00:30:41.840560Z","title":"Inference-time scaling for diffusion models beyond scaling denoising steps.arXiv preprint arXiv:2501.09732, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.840560Z"},"links":{"cited_paper":"/paper/2501.09732","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:ce6b5d6d47320a413a667c75c3073d727335e929bd7a5f57f349bd6388e12a72","observation_id":"9777df92-c093-4e23-9cc5-87854be48d3d","resolution":{"observed_at":"2026-08-07T00:30:41.840560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10458","last_updated":"2025-02-12T05:30:08Z","snapshot_observed_at":"2026-08-09T19:20:46.499732Z","submitted_at":"2025-02-12T05:30:08Z","title":"I Think, Therefore I Diffuse: Enabling Multimodal In-Context Reasoning in Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10458","snapshot_observed_at":"2026-08-07T00:30:41.848847Z","title":"I think, therefore i diffuse: Enabling multimodal in-context reasoning in diffusion models.arXiv preprint arXiv:2502.10458, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.848847Z"},"links":{"cited_paper":"/paper/2502.10458","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:4a52cf56d1a7b0bda079f8729f550bd24cc909ab4a683b4186a3383af249adbf","observation_id":"6b9f5c38-17bd-4f58-bd65-fb5155828610","resolution":{"observed_at":"2026-08-07T00:30:41.848847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-07T17:14:39.278754Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-07T00:30:41.860635Z","title":"Webgpt: Browser-assisted question-answering with human feedback.arXiv preprint arXiv:2112.09332, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.860635Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:f7394cf1f52fbe7e01c8e070ebaa2fe23baeca0b7ff151ee096d999283f637f1","observation_id":"0f423950-1882-45d7-8abb-cd0a711f2691","resolution":{"observed_at":"2026-08-07T00:30:41.860635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.875785Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.875785Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:39dc4fc37835c8fe8c15a2e55f6563eec69abbba0ebe0312c8f21d9f418cfccf","observation_id":"12399105-a2c3-4f0f-b701-9eb16d183e2d","resolution":{"observed_at":"2026-08-07T00:30:41.875785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.890883Z","title":"Strengthening multimodal large language model with bootstrapped preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.890883Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:d6cb38645e4a0ac8bae1666d9c16a8bc5e70852d1fb2c083380a03f999742261","observation_id":"5841276b-027f-4929-94a0-b78162b92d69","resolution":{"observed_at":"2026-08-07T00:30:41.890883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.914031Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.914031Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:85f5c8dbeb0704c370d609f4d7ba1880403dec6105e94823845755041d7533ce","observation_id":"4c6cd148-664b-4450-a78c-2df5df412f4a","resolution":{"observed_at":"2026-08-07T00:30:41.914031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.933907Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.933907Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:57d846cc97c51f4a292fb910a8c936bcb612621240b853ec89d0da64eec67256","observation_id":"bce60e70-b049-4018-b188-1f249bb33470","resolution":{"observed_at":"2026-08-07T00:30:41.933907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T00:30:41.940941Z","title":"Hierarchical text-conditional image generation with clip latents.arXiv preprint arXiv:2204.06125, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.940941Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:8c972fa009a6cc8764cd28f1d51842c0a7f83635d4caa346e1c7e05ede59b712","observation_id":"3fe2089a-88b8-4143-b046-b4f2c2b2c76a","resolution":{"observed_at":"2026-08-07T00:30:41.940941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.950270Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.950270Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:e576d2a03f45113aa72ad1b6f500e45796b0720b1f5752bca0dbdde8b7f8e58a","observation_id":"22d46e6a-022c-45c2-b958-2ac1c370b7a5","resolution":{"observed_at":"2026-08-07T00:30:41.950270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.956835Z","title":"Image super-resolution via iterative refinement.IEEE transactions on pattern analysis and machine intelligence, 45(4):4713–4726, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.956835Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:0b64e14bd06c6229ef1bf8e6b548786b3f3113e56e780d1ae35eed6a4042b513","observation_id":"6a2db9c5-4655-4af1-8a23-072f3b67cc63","resolution":{"observed_at":"2026-08-07T00:30:41.956835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T00:30:41.965949Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.965949Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:6c04f18884c3da0b7596d4591ef326655b954e7af387ce9a813a0af03005c9cf","observation_id":"d5793423-9f43-4ed4-8209-3664a944ce35","resolution":{"observed_at":"2026-08-07T00:30:41.965949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06848","last_updated":"2025-07-18T17:52:45Z","snapshot_observed_at":"2026-07-06T20:19:55.486841Z","submitted_at":"2025-01-12T15:34:24Z","title":"A General Framework for Inference-time Scaling and Steering of Diffusion Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06848","snapshot_observed_at":"2026-08-07T00:30:41.972027Z","title":"A general framework for inference-time scaling and steering of diffusion models.arXiv preprint arXiv:2501.06848, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.972027Z"},"links":{"cited_paper":"/paper/2501.06848","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:b666f4185efcb39162d019ff33e86112965aee019b0dafa28a85a31c95fb65bc","observation_id":"ac1868c7-14d1-4db7-9002-330742ff246d","resolution":{"observed_at":"2026-08-07T00:30:41.972027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:41.980877Z","title":"Deep unsuper- vised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.980877Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:9e8e66d28fc89e671e5a196c54cbc5b4565e0e284c632fd623664489cbe2974e","observation_id":"02d842b0-5173-402b-ba6f-d74692f07d9c","resolution":{"observed_at":"2026-08-07T00:30:41.980877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T00:30:41.996389Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.996389Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:137fd71dbbc4313ceb46417f03dff1c5cfe8bca3771d543ca75b97f0de8e7e19","observation_id":"ab857120-8652-453d-aae5-600ec1359548","resolution":{"observed_at":"2026-08-07T00:30:41.996389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:43.960493Z","title":"Journeydb: A benchmark for generative image understanding, 2023","venue":null,"work_id":"a27045c6-fe6d-42b3-91b5-f80dcac07cbc","year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.009631Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:5f222485d9f44e7129114e93fc5388e7f61d542a840b2cf6fcca26bf165e1a02","observation_id":"05f11f8c-7915-48dc-aa48-e46885fbd4a9","resolution":{"observed_at":"2026-08-07T00:30:43.968749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-09T20:05:31.409634Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-07T00:30:42.020725Z","title":"Chameleon: Mixed-modal early-fusion foundation models.arXiv preprint arXiv:2405.09818, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.020725Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:4995b074734715bbec32e2446d31b5c1c5fae5e8669d4c3938e1ff8302ffd27f","observation_id":"5b38659c-ae00-4699-9671-49fed70fb577","resolution":{"observed_at":"2026-08-07T00:30:42.020725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:43.922690Z","title":"Towards accurate generative models of video: A new metric and challenges, 2019","venue":null,"work_id":"d8d84935-cd81-4042-8490-171a4fd60f43","year":2019},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.038049Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:35ceb386178093d41c0dd49c41e11592b1149dd7c2d41251243507aef1c95df2","observation_id":"fc86cd10-143e-4bb9-83a3-2de6f8ea16a9","resolution":{"observed_at":"2026-08-07T00:30:43.934031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:42.051728Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.051728Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:679201b1ee6a77b3b4076dd58edc9aab5ec484ccf0b1c4f54629a28428265bfa","observation_id":"adc4dc03-f508-400d-9a07-7f0fc015b248","resolution":{"observed_at":"2026-08-07T00:30:42.051728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T00:30:42.068201Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.068201Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:13ddfda6e02c3ec797b54043c08bde9f2d100969bbcd4d4d79174cabfbf2d982","observation_id":"d0fb532b-e866-493b-b3ee-1f8e9e780458","resolution":{"observed_at":"2026-08-07T00:30:42.068201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06098","last_updated":"2024-09-30T06:51:55Z","snapshot_observed_at":"2026-08-09T12:28:59.101120Z","submitted_at":"2024-03-10T05:40:12Z","title":"VidProM: A Million-scale Real Prompt-Gallery Dataset for Text-to-Video Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06098","snapshot_observed_at":"2026-08-07T00:30:42.088490Z","title":"Vidprom: A million-scale real prompt-gallery dataset for text-to- video diffusion models.arXiv preprint arXiv:2403.06098, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.088490Z"},"links":{"cited_paper":"/paper/2403.06098","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:0470b5c31820add9716b1594cc1d878b3068df785bae3af3841e66475f5d98e6","observation_id":"032d4e25-1e66-414b-a28f-84a54565cee8","resolution":{"observed_at":"2026-08-07T00:30:42.088490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-07T00:30:42.096528Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation.arXiv preprint arXiv:2307.06942, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.096528Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:f4b14f3e0f8969332e4fe54065b37201b6362bb62fe97d7b3c21f9e967ad25a5","observation_id":"2a27074b-2994-4a4c-a2fd-60636dec451c","resolution":{"observed_at":"2026-08-07T00:30:42.096528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-07-06T15:43:07.989730Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-07T00:30:42.119893Z","title":"Human preference score v2: A solid benchmark for evaluating human preferences of text-to-image synthesis.arXiv preprint arXiv:2306.09341, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.119893Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:9fee2952a3f4eeff0ec12c6edb6ccde481e39a793fa16e6735b6d77d76f34acb","observation_id":"3e847fa2-3662-40b9-96ac-22fd8619043d","resolution":{"observed_at":"2026-08-07T00:30:42.119893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21059","last_updated":"2026-01-05T02:39:01Z","snapshot_observed_at":"2026-08-03T02:30:08.318253Z","submitted_at":"2024-12-30T16:24:09Z","title":"VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21059","snapshot_observed_at":"2026-08-07T00:30:42.130282Z","title":"Visionreward: Fine-grained multi-dimensional human preference learning for image and video generation.arXiv preprint arXiv:2412.21059, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.130282Z"},"links":{"cited_paper":"/paper/2412.21059","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:3c772a70056bd14a923a295afbcb7c305f3db46f84797161cf68600c348d604c","observation_id":"98c63fd1-d44f-4978-90c2-e189e74f7575","resolution":{"observed_at":"2026-08-07T00:30:42.130282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:42.145782Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.145782Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:2a730abc07b375085df898c010120a72c28fe1cd352266e7b10e4eb4c7376aaa","observation_id":"fb9a109b-59e6-4634-84d4-bedf514edf8b","resolution":{"observed_at":"2026-08-07T00:30:42.145782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:42.153774Z","title":"Using human feedback to fine-tune diffusion models without any reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.153774Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:cc9032ecf40a2fe88762054679c4cf0d7a386d86d30afbc70110239f675925cf","observation_id":"cb302e3c-57e3-4c40-b7dc-e25cf8b0779c","resolution":{"observed_at":"2026-08-07T00:30:42.153774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03337","last_updated":"2024-05-24T09:17:29Z","snapshot_observed_at":"2026-08-09T03:27:00.139869Z","submitted_at":"2023-10-05T06:44:13Z","title":"Denoising Diffusion Step-aware Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03337","snapshot_observed_at":"2026-08-07T00:30:42.168136Z","title":"Denoising diffusion step-aware models.arXiv preprint arXiv:2310.03337, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.168136Z"},"links":{"cited_paper":"/paper/2310.03337","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:ef926c3cf2ee6921fd86bf10fbcbb80718639bba324beff6c7c0489b3994f898","observation_id":"0cd7a784-37da-4ef3-939b-4029bb348422","resolution":{"observed_at":"2026-08-07T00:30:42.168136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T00:30:42.179645Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.179645Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:d5a97eefc7cc0069b366b1713d228062ce4b85f309f84ae1465ba7e4ebcc6d0b","observation_id":"34e8547d-1ba2-4324-b023-767b55214d38","resolution":{"observed_at":"2026-08-07T00:30:42.179645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:42.189382Z","title":"The unreason- able effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.189382Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:de0d4aedb52550f89bf0440d278edeedd7df427d0a8ff387acd3107d51678d13","observation_id":"8e908471-7375-49c9-bde7-a2c49197e391","resolution":{"observed_at":"2026-08-07T00:30:42.189382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T00:30:42.199545Z","title":"\"fuck the police","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:42.199545Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:79472d789b7d85664b76c6dd530eab24d03b34871cd3d1aa0cf8c551483ce42f","observation_id":"7dd893d2-0c57-4e1e-948b-8d1237ae8727","resolution":{"observed_at":"2026-08-07T00:30:42.199545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:44.539152Z","title":null,"venue":null,"work_id":"def310ab-c861-4231-a6fd-f8b0764d0831","year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.557215Z"},"links":{"citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:d4ba2f85e8cfedf2d0e719b38c69b66067ce1962a3edf12d4541f84252c811ad","observation_id":"9797ec40-089f-47dc-96c8-5beeebb40932","resolution":{"observed_at":"2026-08-07T00:30:44.556851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2506.13846."}