{"as_of":"2026-08-07T12:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d226d2bc2ab3ed3994361e4d6f6f70aad24d42dda99fa213d9c92bc8fb89a566","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:04:32.296569Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20368/citation-record","integrity":"/paper/2607.20368/integrity","json":"/paper/2607.20368/citation-record.json","paper":"/paper/2607.20368"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.12945","last_updated":"2024-02-05T16:36:30Z","snapshot_observed_at":"2026-08-07T01:22:41.601795Z","submitted_at":"2024-01-23T18:05:25Z","title":"Lumiere: A Space-Time Diffusion Model for Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12945","snapshot_observed_at":"2026-08-01T10:04:30.006159Z","title":"Lumiere: A space-time diffusion model for video generation.arXiv preprint arXiv:2401.12945,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:30.006159Z"},"links":{"cited_paper":"/paper/2401.12945","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:e15359fb48d309acc37d01a20ec2e607f3f840d42e8d4761950fe93c40c0d934","observation_id":"5117d56a-9fab-4d86-ae46-54ecd5dd96ce","resolution":{"observed_at":"2026-08-01T10:04:30.006159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:04:32.160366Z","title":"Metrics are rows and model variants are columns, and boldface marks the better value within each matched Self Forcing–SGF pair","venue":null,"work_id":null,"year":2060},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:32.160366Z"},"links":{"citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:376a46021db1848244f6f2f7671f5f849d20abd8773accd84f16905304b000f0","observation_id":"01d2ddbd-a4c9-44ae-8b87-c240f620a014","resolution":{"observed_at":"2026-08-01T10:04:32.160366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25161","last_updated":"2025-09-29T17:57:14Z","snapshot_observed_at":"2026-07-06T22:31:10.099674Z","submitted_at":"2025-09-29T17:57:14Z","title":"Rolling Forcing: Autoregressive Long Video Diffusion in Real Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25161","snapshot_observed_at":"2026-08-01T10:04:30.536518Z","title":"Rolling forcing: Autoregressive long video diffusion in real time.arXiv preprint arXiv:2509.25161,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:30.536518Z"},"links":{"cited_paper":"/paper/2509.25161","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:b2191010b324abf5495b5a8feaa833ffe88f2f3305cb33f09175ef24e508bde3","observation_id":"4d0c38cd-cfd0-465d-bb3a-004410d1d758","resolution":{"observed_at":"2026-08-01T10:04:30.536518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:04:30.677725Z","title":"Shotstream: Streaming multi-shot video generation for interactive storytelling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:30.677725Z"},"links":{"citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:197f245f3a6127991f681dd1e3f5a646f438b3c4447172e8492c01a5088ddd19","observation_id":"75894a07-01b2-480c-a92b-b6524f462b0e","resolution":{"observed_at":"2026-08-01T10:04:30.677725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.13035","last_updated":"2026-06-11T08:16:08Z","snapshot_observed_at":"2026-07-06T23:51:49.819867Z","submitted_at":"2026-06-11T08:16:08Z","title":"TetherCache: Stabilizing Autoregressive Long-Form Video Generation with Gated Recall and Trusted Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.13035","snapshot_observed_at":"2026-08-01T10:04:30.787772Z","title":"Tethercache: Stabilizing autoregressive long-form video generation with gated recall and trusted alignment.arXiv preprint arXiv:2606.13035,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:30.787772Z"},"links":{"cited_paper":"/paper/2606.13035","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:c3cfe51339c94f1d0d96e026d5936a978905c996889a0416329abe6016a76515","observation_id":"a0fdd9b8-dc9f-4a68-9d1d-a556df509efe","resolution":{"observed_at":"2026-08-01T10:04:30.787772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.14487","last_updated":"2026-05-14T07:27:39Z","snapshot_observed_at":"2026-08-06T04:41:33.559035Z","submitted_at":"2026-05-14T07:27:39Z","title":"Head Forcing: Long Autoregressive Video Generation via Head Heterogeneity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.14487","snapshot_observed_at":"2026-08-01T10:04:31.355102Z","title":"Head forcing: Long autoregressive video generation via head heterogeneity.arXiv preprint arXiv:2605.14487,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.355102Z"},"links":{"cited_paper":"/paper/2605.14487","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:229c3e7dd0a5eb90c6731f32f06257a9b3f46e6fc8bbef1805bd828facebaf61","observation_id":"51594d17-2d10-4941-a1ee-e71e4b9bbbc1","resolution":{"observed_at":"2026-08-01T10:04:31.355102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18264","last_updated":"2023-05-29T17:38:18Z","snapshot_observed_at":"2026-07-06T15:34:51.593721Z","submitted_at":"2023-05-29T17:38:18Z","title":"Gen-L-Video: Multi-Text to Long Video Generation via Temporal Co-Denoising","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18264","snapshot_observed_at":"2026-08-01T10:04:31.470364Z","title":"Gen-l-video: Multi-text to long video generation via temporal co-denoising.arXiv preprint arXiv:2305.18264,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.470364Z"},"links":{"cited_paper":"/paper/2305.18264","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:76f1499ab6fdf30bb31fc57e54f64972f75da49d7b67db3e2eb205b8bc7874de","observation_id":"8704be00-5a6b-4ac3-bb9a-8ddde7b31e4b","resolution":{"observed_at":"2026-08-01T10:04:31.470364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08995","snapshot_observed_at":"2026-08-01T10:04:31.583721Z","title":"Matrix-game 3.0: Real-time and streaming interactive world model with long- horizon memory.arXiv preprint arXiv:2604.08995,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.583721Z"},"links":{"cited_paper":"/paper/2604.08995","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:ef22b8bfc53a93198439eaf3b3e2f8a6201b125ed61078d0ca7ab74dfe1cd159","observation_id":"89b57b46-3ce4-47cd-b3b4-cae9575e7234","resolution":{"observed_at":"2026-08-01T10:04:31.583721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21221","last_updated":"2026-04-23T02:22:25Z","snapshot_observed_at":"2026-07-06T23:07:51.979267Z","submitted_at":"2026-04-23T02:22:25Z","title":"Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.21221","snapshot_observed_at":"2026-08-01T10:04:31.640087Z","title":"Sparse forcing: Native trainable sparse attention for real-time autoregressive diffusion video generation.arXiv preprint arXiv:2604.21221, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.640087Z"},"links":{"cited_paper":"/paper/2604.21221","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:4d8a2fc366cc5e9a4f50afbdc2a2f881ed1127572e9e3f9eb8b4fdb9164dbab0","observation_id":"1c26e9e7-7153-4805-bb51-abee0dd97d53","resolution":{"observed_at":"2026-08-01T10:04:31.640087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:04:31.713671Z","title":"Infinity- RoPE: Action-controllable infinite video generation emerges from autoregressive self-rollout","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.713671Z"},"links":{"citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:5e861ecae4765c1947aeb5fdf332f6457ea697c0ebbf625693ada1757625f548","observation_id":"e30eafc7-78b2-436e-8f9b-a785006f819d","resolution":{"observed_at":"2026-08-01T10:04:31.713671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.03971","last_updated":"2026-06-02T17:55:13Z","snapshot_observed_at":"2026-07-06T23:44:09.692359Z","submitted_at":"2026-06-02T17:55:13Z","title":"Video-Mirai: Autoregressive Video Diffusion Models Need Foresight","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.03971","snapshot_observed_at":"2026-08-01T10:04:31.802969Z","title":"Video-mirai: Autore- gressive video diffusion models need foresight.arXiv preprint arXiv:2606.03971,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.802969Z"},"links":{"cited_paper":"/paper/2606.03971","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:985180f8fe33a42a73e28e95b1a96275bffa46afbeae997f51c86c62011386a5","observation_id":"f45d600d-df05-4678-8521-8b12c3b59db7","resolution":{"observed_at":"2026-08-01T10:04:31.802969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15141","last_updated":"2026-06-01T14:27:49Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:46:36Z","title":"Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15141","snapshot_observed_at":"2026-08-01T10:04:31.904810Z","title":"Causal forcing++: Scalable few-step autoregressive diffusion distil- lation for real-time interactive video generation.arXiv preprint arXiv:2605.15141,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.904810Z"},"links":{"cited_paper":"/paper/2605.15141","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:8f51faef8a2c8a41b3e39b7af73fab128ac8d6af6f5c3b60be068212e0db6a14","observation_id":"9899bd93-0ef3-4863-850a-14ea91931ad2","resolution":{"observed_at":"2026-08-01T10:04:31.904810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02214","snapshot_observed_at":"2026-08-01T10:04:31.984853Z","title":"Causal forcing: Autoregressive diffusion distillation done right for high-quality real-time interactive video gener- ation.arXiv preprint arXiv:2602.02214,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.984853Z"},"links":{"cited_paper":"/paper/2602.02214","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:44c2d7ad041833ea4a893dfe7a202f22701f0b572af867f311d75506aacac0a1","observation_id":"505c725a-8571-4944-b94d-05f1402f797d","resolution":{"observed_at":"2026-08-01T10:04:31.984853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:04:32.050650Z","title":"The 5-second setting follows the standard VBench protocol and reports all 16 quality and semantic dimensions","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:32.050650Z"},"links":{"citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:e91b8e14d6baae5202bb984ce39301f2f98a8ecab11bce76a910eb5086b7703a","observation_id":"616d1db3-5612-43c3-ad7b-9a889fbd8c73","resolution":{"observed_at":"2026-08-01T10:04:32.050650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:04:32.296569Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:32.296569Z"},"links":{"citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:d739b08fa89f9252e558daeb376272a5dbe5907947b8ef79ac528287e8be1d61","observation_id":"5bb28a15-df2d-4f85-8660-e448362699e7","resolution":{"observed_at":"2026-08-01T10:04:32.296569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-01T10:04:30.200361Z","title":"Kingma, Ben Poole, Mohammad Norouzi, David J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:30.200361Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:986a070e8a296a15f75367434002f2be685218a299e2b22181d7691be36bd097","observation_id":"16b4f74e-0762-4a8c-871a-24b5c40c4b17","resolution":{"observed_at":"2026-08-01T10:04:30.200361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-01T10:04:31.217460Z","title":"Roformer: En- hanced transformer with rotary position embedding.arXiv preprint arXiv:2104.09864,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.217460Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:1f51968700f888ae77cc3624b3e318121281b08ff9cf4e1ff68d77c649c5bad5","observation_id":"e535d640-c8a9-4068-a69d-8191b318986c","resolution":{"observed_at":"2026-08-01T10:04:31.217460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:04:31.034392Z","title":"Solaris: Building a multiplayer video world model in minecraft.arXiv preprint arXiv:2602.22208,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:31.034392Z"},"links":{"citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:3976ed312b7b4d4526d2ceb603833c75adc42b733d91af20cd1e330f9847283a","observation_id":"35447260-c31c-49fc-9123-659eb0a28010","resolution":{"observed_at":"2026-08-01T10:04:31.034392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-01T10:04:30.907982Z","title":"Movie gen: A cast of media founda- tion models.arXiv preprint arXiv:2410.13720,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:30.907982Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:08f0e3c3d87d77d093159666a5cc3e77a0793c78a237caa06e49597e2c0ff7cb","observation_id":"a0d53b5a-53ed-4701-8a66-7ef6fb7b5acf","resolution":{"observed_at":"2026-08-01T10:04:30.907982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-01T10:04:30.101042Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:30.101042Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:70ba4a7ab99013ce8c66dff272e290dfa494780894b4c96e4cb5b10d5dd0487d","observation_id":"730e479e-aec8-4453-ab07-60e652c5f31d","resolution":{"observed_at":"2026-08-01T10:04:30.101042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09681","last_updated":"2026-05-10T17:59:21Z","snapshot_observed_at":"2026-08-06T13:37:27.647195Z","submitted_at":"2026-05-10T17:59:21Z","title":"Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09681","snapshot_observed_at":"2026-08-01T10:04:30.420503Z","title":"Forcing-kv: Hybrid kv cache compression for efficient autoregressive video diffusion models.arXiv preprint arXiv:2605.09681,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:30.420503Z"},"links":{"cited_paper":"/paper/2605.09681","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:8dbc1c4f56905f441265ba9ecedf6bcafef80994e9a1dcbfa37a9c63de0c28c2","observation_id":"93843596-239c-4b6f-87db-b840e8cb5a04","resolution":{"observed_at":"2026-08-01T10:04:30.420503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-01T10:04:30.320489Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T10:04:30.320489Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2607.20368"},"observation_digest":"sha256:e1015be118f8ef80a045713f96ddce020116da47751dbaac9d0067f1eab72779","observation_id":"1d499ebe-e1ca-448b-92e5-6f9c56e5b276","resolution":{"observed_at":"2026-08-01T10:04:30.320489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20368","last_updated":"2026-07-24T08:16:28Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T04:42:02.905359Z","submitted_at":"2026-07-22T16:59:23Z","title":"Self Gradient Forcing: Native Long Video Extrapolation"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2607.20368."}