{"as_of":"2026-08-20T16:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:866a154932f072f448d99f98aedf039f5a44a624417d9b2670587c4dcd463ea6","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T19:09:45.723704Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28058/citation-record","integrity":"/paper/2607.28058/integrity","json":"/paper/2607.28058/citation-record.json","paper":"/paper/2607.28058"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.582133Z","title":"Realdpo: Real or not real, that is the preference.arXiv preprint arXiv:2510.14955, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.582133Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:b4ad6e64c1f418bb6cc636c59e11533d474f840a9d91bdc6aa31c064b163c55c","observation_id":"86454b38-18bf-4e9d-b0d6-bfa5b1e4955d","resolution":{"observed_at":"2026-07-31T19:09:45.582133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08542","last_updated":"2025-04-11T13:55:48Z","snapshot_observed_at":"2026-08-19T19:14:51.786279Z","submitted_at":"2025-04-11T13:55:48Z","title":"Discriminator-Free Direct Preference Optimization for Video Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08542","snapshot_observed_at":"2026-07-31T19:09:45.588224Z","title":"Discriminator-free direct preference optimization for video diffusion.arXiv preprint arXiv:2504.08542, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.588224Z"},"links":{"cited_paper":"/paper/2504.08542","citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:ce7234963e5f881c9f660d9c779c2620e093206a512241bdbf2033d466f7055d","observation_id":"7c560658-122d-4678-aa2b-2208788af306","resolution":{"observed_at":"2026-07-31T19:09:45.588224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.08423","last_updated":"2026-07-20T08:31:09Z","snapshot_observed_at":"2026-08-10T18:57:41.616541Z","submitted_at":"2025-11-11T16:33:49Z","title":"OmniAID: Decoupling Semantics and Artifacts for Universal AI-Generated Image Detection in the Wild","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.08423","snapshot_observed_at":"2026-07-31T19:09:45.594102Z","title":"Omniaid: Decoupling semantic and artifacts for universal ai-generated image detection in the wild.arXiv preprint arXiv:2511.08423, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.594102Z"},"links":{"cited_paper":"/paper/2511.08423","citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:715df18e558ebfd95f648638f28abf9cbf52635d8a1dcc26b6adcf2664e30997","observation_id":"6f9ff98e-d75a-4381-bc27-b85fbed3904c","resolution":{"observed_at":"2026-07-31T19:09:45.594102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.599872Z","title":"Motionbench: Benchmarking and improving fine-grained video motion understanding for vision language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.599872Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:5ae8f7ca9127c7ff110987466c905a6134d0d8a74461370dbf339a97185002e5","observation_id":"f64605ec-593e-484e-9fe4-662196603a02","resolution":{"observed_at":"2026-07-31T19:09:45.599872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.605231Z","title":"Lora: Low-rank adaptation of large language models.Iclr, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.605231Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:e06a70e153c952de5c1003100d3f483935636e81336323a0fb7b3629643008eb","observation_id":"7007007c-4f85-4797-832a-e38d133312ce","resolution":{"observed_at":"2026-07-31T19:09:45.605231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.610909Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.610909Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:c737aa2e47c83698da481d3cdf813fc5e62f42c2ced4259ee27681bf21509da0","observation_id":"0e3edd3e-257c-4681-9084-20b3909ced86","resolution":{"observed_at":"2026-07-31T19:09:45.610909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04068","last_updated":"2026-05-20T06:08:56Z","snapshot_observed_at":"2026-08-16T10:53:06.656788Z","submitted_at":"2026-01-07T16:32:17Z","title":"Mind the Generative Details: Direct Localized Detail Preference Optimization for Video Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.04068","snapshot_observed_at":"2026-07-31T19:09:45.618520Z","title":"Mind the generative details: Direct localized detail preference optimization for video diffusion models.arXiv preprint arXiv:2601.04068, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.618520Z"},"links":{"cited_paper":"/paper/2601.04068","citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:ce9d1a90a18a47c6c2bbb3f70062981acbca4cf58102c57648dda2b55b0f778c","observation_id":"505eeec6-eb88-4ff4-abf5-a6f41facce13","resolution":{"observed_at":"2026-07-31T19:09:45.618520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.624724Z","title":"Vace: All-in- one video creation and editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.624724Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:8a5a5a5f36ef52d4daa2e4818bacfaa325374bb3b377e3a3d47d5e477c859c5a","observation_id":"ebe665f6-3417-4a3d-afc5-263c4a581b3e","resolution":{"observed_at":"2026-07-31T19:09:45.624724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.630114Z","title":"Seeing before reasoning: A unified framework for generalizable and explainable fake image detection.arXiv preprint arXiv:2509.25502, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.630114Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:82b1bfcf55d3d8a04fba5ffafe2e8943b9a2389918b4df27da163a24ebd94d84","observation_id":"7c61cb3a-e7dc-4195-a1ab-0373b5825c19","resolution":{"observed_at":"2026-07-31T19:09:45.630114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.635409Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.635409Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:89a5af9817736d33472e25141d9a58ae452a252436ed30fce8f1ab29132719f1","observation_id":"ba0d5f0b-78e8-4083-8b42-2dd830d63f49","resolution":{"observed_at":"2026-07-31T19:09:45.635409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.640551Z","title":"Improving video generation with human feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.640551Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:0267035786ab7dd3e127c3b409ca8fd62b9c7fc4512331b0f5c2b218eebc2323","observation_id":"677e902d-b8e4-42f2-b4fe-f416f1a94dbc","resolution":{"observed_at":"2026-07-31T19:09:45.640551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13228","last_updated":"2024-07-03T13:46:33Z","snapshot_observed_at":"2026-08-14T02:18:02.339361Z","submitted_at":"2024-02-20T18:42:34Z","title":"Smaug: Fixing Failure Modes of Preference Optimisation with DPO-Positive","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13228","snapshot_observed_at":"2026-07-31T19:09:45.651676Z","title":"Smaug: Fixing failure modes of preference optimisation with dpo-positive.arXiv preprint arXiv:2402.13228, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.651676Z"},"links":{"cited_paper":"/paper/2402.13228","citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:5183d17a0708e4e5d9c0363276fadb422527e10588316b93bfb8f4b181f56457","observation_id":"0f58d5d4-7350-4777-afdc-477bd905d1e3","resolution":{"observed_at":"2026-07-31T19:09:45.651676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.660724Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.660724Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:c234d8369dd30237fde24306895015d2b86b8926715cfecd4052d91510a2b4c1","observation_id":"10c469ce-7740-4e33-b3db-e5b84e878b8f","resolution":{"observed_at":"2026-07-31T19:09:45.660724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.670484Z","title":"Wisa: World simulator assistant for physics-aware text-to-video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.670484Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:63bd04d19ca6273508696bbe5fb839719e0836e3e4525f0ad68f53ece0d0c4f8","observation_id":"168923a6-df71-4b51-8826-104714afd648","resolution":{"observed_at":"2026-07-31T19:09:45.670484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04814","last_updated":"2025-03-05T02:43:42Z","snapshot_observed_at":"2026-08-19T22:35:54.363867Z","submitted_at":"2024-12-06T07:16:14Z","title":"LiFT: Leveraging Human Feedback for Text-to-Video Model Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04814","snapshot_observed_at":"2026-07-31T19:09:45.675824Z","title":"Lift: Leveraging human feedback for text-to-video model alignment.arXiv preprint arXiv:2412.04814, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.675824Z"},"links":{"cited_paper":"/paper/2412.04814","citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:84f2b95e0b677b4cf6c9a1fe10ac266f7fddfcbe59321dac642d82cf140fa0f2","observation_id":"547c4f4d-b0eb-40c6-8583-dadb4b70a32b","resolution":{"observed_at":"2026-07-31T19:09:45.675824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-08-20T00:42:38.595341Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05236","snapshot_observed_at":"2026-07-31T19:09:45.685548Z","title":"Unified reward model for multimodal understanding and generation.arXiv preprint arXiv:2503.05236, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.685548Z"},"links":{"cited_paper":"/paper/2503.05236","citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:79c46fcaeb906db4d3e15a5aa8464311d409337d88e42a6813baceb410ae0420","observation_id":"a684158e-9799-481d-a412-ca38d136a673","resolution":{"observed_at":"2026-07-31T19:09:45.685548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.692588Z","title":"Densedpo: Fine-grained temporal preference optimization for video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.692588Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:9c89704cf3ace63f078caa27cf7be7d948ae3a85faaf368ff7726d1ddcba7e2a","observation_id":"81ba2f4b-e3cc-4ec9-a229-531841872c9e","resolution":{"observed_at":"2026-07-31T19:09:45.692588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.699465Z","title":"Dlfr-vae: Dynamic latent frame rate vae for video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.699465Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:10d4b13e2b52a575dc1fd45f5408283e18ca602e4e0c076f485df188889d4c21","observation_id":"531f215f-3cf7-43db-8734-3a591c21712f","resolution":{"observed_at":"2026-07-31T19:09:45.699465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.705950Z","title":"Dlfr-gen: Diffusion-based video generation with dynamic latent frame rate","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.705950Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:b6eef9ebf0bfbe9b59cc091d020682cf612856010cda52ac96a5963eebe3a253","observation_id":"190c8d90-96e2-4866-832d-95a2b4ba17fa","resolution":{"observed_at":"2026-07-31T19:09:45.705950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12259","last_updated":"2025-04-16T17:09:13Z","snapshot_observed_at":"2026-08-18T16:06:19.154562Z","submitted_at":"2025-04-16T17:09:13Z","title":"VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12259","snapshot_observed_at":"2026-07-31T19:09:45.710658Z","title":"Vgdfr: Diffusion-based video generation with dynamic latent frame rate","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.710658Z"},"links":{"cited_paper":"/paper/2504.12259","citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:c94d4cfacd57bdbe9535cd76f15dd0b1aa3e7899138d5febda7ab53e439aaeed","observation_id":"66ba069b-b811-46f8-b150-417ec937ff7f","resolution":{"observed_at":"2026-07-31T19:09:45.710658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:09:45.723704Z","title":"Onlinevpo: Align video diffusion model with online video-centric preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T19:09:45.723704Z"},"links":{"citing_paper":"/paper/2607.28058"},"observation_digest":"sha256:2676f34e45234c2bd2bfede51f742b333045e80a1da89532584e72fd94c31dbe","observation_id":"9036e121-e33f-40b6-9074-dc456b202dc7","resolution":{"observed_at":"2026-07-31T19:09:45.723704Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28058","last_updated":"2026-07-30T11:36:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T16:46:42.684350Z","submitted_at":"2026-07-30T11:36:48Z","title":"Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2607.28058."}