{"as_of":"2026-08-11T17:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:548ab48b2b15564fa5fce4b7210ae47b72517cda7859d56b70cead43000cc7f2","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T04:52:49.796613Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03974/citation-record","integrity":"/paper/2608.03974/integrity","json":"/paper/2608.03974/citation-record.json","paper":"/paper/2608.03974"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:54.363377Z","title":"Happyhorse 1.0.https://happy-horse.ai/docs/basic-usage, 2026","venue":null,"work_id":"b8368716-003c-4e50-8e96-9ae7789b86de","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:44.567105Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:906e79575aa2add8c69c3ca7e3207d60b412203c40af1db6c8778354f0a2a216","observation_id":"f9a67ef3-0d64-44ad-8bde-47b501c5c7b9","resolution":{"observed_at":"2026-08-05T04:52:54.427345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:54.153133Z","title":"L., Ma, S., Zeng, Y., Liu, Z., Xu, Y., Shen, Y., and Chen, Q","venue":null,"work_id":"4a7378fd-120f-49dd-b901-4703075de30a","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:44.617517Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:f6e30161bb2716f80af97d3b2dd07420e1d79963f5bb560714b9974a052c70fc","observation_id":"0685b7df-5f0a-4063-9c6a-6a0045c0af1c","resolution":{"observed_at":"2026-08-05T04:52:54.254923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.22344","last_updated":"2026-05-21T11:30:29Z","snapshot_observed_at":"2026-07-06T23:32:39.761431Z","submitted_at":"2026-05-21T11:30:29Z","title":"Bernini: Latent Semantic Planning for Video Diffusion","version":1},"cited_work":{"arxiv_id":"2605.22344","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.22344","snapshot_observed_at":"2026-08-05T04:52:50.794493Z","title":"Bernini: Latent Semantic Planning for Video Diffusion","venue":"cs.CV","work_id":"f0f49693-f353-4389-8211-500096080a15","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:44.717657Z"},"links":{"cited_paper":"/paper/2605.22344","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:63ae4c51035fa06b74def854472c127165b4e293a4fb9f7b9698a6568840c5ab","observation_id":"fdf7bb28-a685-48a1-9fa7-8e472a44a713","resolution":{"observed_at":"2026-08-05T04:52:50.883963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-08-11T10:01:39.973258Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-05T04:52:44.823021Z","title":"Seedance 2.0: Advancing video generation for world complexity.arXiv preprintarXiv:2604.14148, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:44.823021Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:3ef247b8ef860c6423a3885531697fc0e59418be81bb7af164b0ab8754acc818","observation_id":"bed6402d-5f3f-4646-97d8-cb0cb2982a09","resolution":{"observed_at":"2026-08-05T04:52:44.823021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:53.931621Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffusion.Advances in Neural Information Processing Systems, 37:24081–24125, 2024","venue":null,"work_id":"560bdf80-bdda-464c-a91b-b418df68ba43","year":2024},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:44.913207Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:73fa86bcea593fe8276d4aaf48d919667176e832ea9da719ee11227e4f5dad9f","observation_id":"22479809-414c-4294-85a2-661a8f58a52c","resolution":{"observed_at":"2026-08-05T04:52:54.035726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13074","last_updated":"2025-04-21T10:34:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-17T16:37:27Z","title":"SkyReels-V2: Infinite-length Film Generative Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13074","snapshot_observed_at":"2026-08-05T04:52:44.989091Z","title":"Skyreels-v2: Infinite-length film generative model.arXiv preprint arXiv:2504.13074, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:44.989091Z"},"links":{"cited_paper":"/paper/2504.13074","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:1d6cd6332fd8d36fb4c172a2a52b06bc20eb6bc3798099f3c19354a9401fed48","observation_id":"ea38c761-5a97-4a42-ad70-4430f218d306","resolution":{"observed_at":"2026-08-05T04:52:44.989091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:45.085826Z","title":"Vino: A unified visual generator with interleaved omnimodal context","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:45.085826Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:a54f984905d2e9632d8ca70ffe6b72b4b6b43813d01fe022194be891761f1d84","observation_id":"3b084a86-1acf-4564-8057-0be92e5e6692","resolution":{"observed_at":"2026-08-05T04:52:45.085826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18739","last_updated":"2026-05-19T17:46:12Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:57:03Z","title":"LongLive-2.0: An NVFP4 Parallel Infrastructure for Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18739","snapshot_observed_at":"2026-08-05T04:52:45.182457Z","title":"Longlive-2.0: An nvfp4 parallel infrastructure for long video generation.arXiv preprint arXiv:2605.18739, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:45.182457Z"},"links":{"cited_paper":"/paper/2605.18739","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:8f222d6cd35bdcf26414bfdb7b331c26c0c45fc747dbf89dd245a93f9de81706","observation_id":"c83029b3-d85b-4171-ac60-ab5295ea5979","resolution":{"observed_at":"2026-08-05T04:52:45.182457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:53.723994Z","title":"Lucy edit: Open-weight text-guided video editing","venue":null,"work_id":"83b728ca-3bc6-49bb-b64d-af11ee48a622","year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:45.307082Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:9606f34c898807906558988d62388ae477a8fd32146658fe763fb93eb124dd8c","observation_id":"84a262ec-0c2b-461a-826d-fc83012204a8","resolution":{"observed_at":"2026-08-05T04:52:53.824255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:45.502457Z","title":"Streamdiffusionv2: A streaming system for dynamic and interactive video generation.arXiv preprint arXiv:2511.07399, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:45.502457Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:459083a3207928ee8de19c0db7ab25bfb3152dcb5b5413897ed0431044cfcbc3","observation_id":"af7dcb4d-3957-4868-a9f1-6141370ff7de","resolution":{"observed_at":"2026-08-05T04:52:45.502457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15702","last_updated":"2026-07-01T03:39:09Z","snapshot_observed_at":"2026-08-06T15:52:47.972204Z","submitted_at":"2025-12-17T18:53:29Z","title":"End-to-End Training for Autoregressive Video Diffusion via Self-Resampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.15702","snapshot_observed_at":"2026-08-05T04:52:45.653260Z","title":"End-to-end training for autoregressive video diffusion via self-resampling.arXiv preprint arXiv:2512.15702, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:45.653260Z"},"links":{"cited_paper":"/paper/2512.15702","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:f5cecdad6d694c52271d9fa5cbf054b995f7b4b3d3e2d2cc3a3519393813b7bb","observation_id":"6ed94429-e3d0-443b-9efe-fb4717baf84c","resolution":{"observed_at":"2026-08-05T04:52:45.653260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:45.751029Z","title":"Openve-3m: A large-scale high-quality dataset for instruction-guided video editing.arXiv preprint arXiv:2512.07826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:45.751029Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:61894452f2cd82e71b460695fa77015d905039225378b97a07f549100131a09a","observation_id":"9ecca0cf-9071-4aae-ac3e-d41da5f5c118","resolution":{"observed_at":"2026-08-05T04:52:45.751029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:53.562231Z","title":"Streamingt2v: Consistent, dynamic, and extendable long video generation from text","venue":null,"work_id":"77423354-29bc-40c9-b155-b42b23717ed0","year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:45.879345Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:4c0fa830104a6091d155d5e04e30f72d4d54810c62691e2de364dbe430972df3","observation_id":"8aa584e4-b93a-4759-9b9b-5b689ef9a3a0","resolution":{"observed_at":"2026-08-05T04:52:53.626268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T04:52:46.044724Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:46.044724Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:ae6c41cb3bdd6fba3c275593318577fa9167c9a82fdee4efcfee5eae3e72a398","observation_id":"e8ebf6bf-ea77-4fba-819f-974086116b67","resolution":{"observed_at":"2026-08-05T04:52:46.044724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:53.346937Z","title":"Vace: All-in-one video creation and editing","venue":null,"work_id":"99b6f3f0-1278-44eb-b0d3-ee15e3a261d7","year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:46.255097Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:17ebdec6ef925df731281e36f51fb1ddc11d2c6ba928108be9d552d55e5cc792","observation_id":"0680d49b-8951-4d43-a56c-9ced71b4be56","resolution":{"observed_at":"2026-08-05T04:52:53.448561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:53.126006Z","title":"Kling o1 launches as the world’s first unified multi- modal video model","venue":null,"work_id":"deff97e0-9513-4888-b34d-06af9e643a50","year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:46.399193Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:89a12dde0e5ef9e42e4ce91e0946dd750a06c1c54e6218f318a6077fa51d4e16","observation_id":"9b06feb3-660a-437d-8859-e907b2b0ba50","resolution":{"observed_at":"2026-08-05T04:52:53.226935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:52.925839Z","title":"Kling ai 3.0 and video 3.0 omni","venue":null,"work_id":"d8fec24f-4318-48b9-8318-ac3ec3929850","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:46.541442Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:f8df7947363041fa7365e0cad59bb01957cf37451c1fbb735c8b0629bed04d4d","observation_id":"799b3972-9cfd-4cd7-8e30-d34f900b6eb0","resolution":{"observed_at":"2026-08-05T04:52:53.000235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:52.682736Z","title":"HP-Edit: A human-preference post-training framework for image editing","venue":null,"work_id":"a4dd9c1b-ea24-4d22-9421-8e606898ad75","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:46.708290Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:5e0a0845fcb22c887d39ad63fd46d4c0c47c8e01dffe63086108fc063b0b48ee","observation_id":"d03e6a0a-c656-4247-a127-3f010f1297d5","resolution":{"observed_at":"2026-08-05T04:52:52.811194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:46.877791Z","title":"In-context learning with unpaired clips for instruction-based video editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:46.877791Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:49bf14f5004c3a115662c0f6a0eeacbfb0f89b037673e6331f8e46cad44319dd","observation_id":"70feb3e1-e609-4459-9b46-35706747017a","resolution":{"observed_at":"2026-08-05T04:52:46.877791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02175","last_updated":"2026-05-13T06:57:11Z","snapshot_observed_at":"2026-08-11T00:13:26.727625Z","submitted_at":"2026-03-02T18:46:28Z","title":"Kiwi-Edit: Versatile Video Editing via Instruction and Reference Guidance","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.02175","snapshot_observed_at":"2026-08-05T04:52:47.193522Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:47.193522Z"},"links":{"cited_paper":"/paper/2603.02175","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:a545edfb213ad5f5344708603416357017549c8cd00192f701d700d31077117c","observation_id":"8215bd8b-7ab1-40d8-97c4-7a04253fa613","resolution":{"observed_at":"2026-08-05T04:52:47.193522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:47.256330Z","title":"Omniweaving: Towards unified video generation with free-form composition and reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:47.256330Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:3bc67c33b117434e0a74492e19c521d16ba49d4085ba23209ffcdfeb64bbbb5c","observation_id":"90e6d1bf-a4a9-4578-9668-959926c1e6e3","resolution":{"observed_at":"2026-08-05T04:52:47.256330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:52.496598Z","title":"Pixverse launches v6, advancing ai video generation across creative and agentic workflows.https: //pixverse.ai/en/blog/pixverse-launches-v6-advancing-ai-video-generation , 2026","venue":null,"work_id":"ec41ed00-9003-4d4b-872c-be20b95bebbd","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:47.381202Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:1de79097d94d184f87aea06d777beeb419d6e325484e33d9e2d94368fee34622","observation_id":"9fd3f90b-34fd-4399-bbc7-d7216e8153bd","resolution":{"observed_at":"2026-08-05T04:52:52.604425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:52.308543Z","title":"Fatezero: Fusing attentions for zero-shot text-based video editing","venue":null,"work_id":"532f702b-384c-462a-a2fd-038b37b1c28c","year":2023},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:47.489325Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:10f05e725ae713eadcb96e130d8f5bde28260e3283ef7593c4abe6d7977ab53a","observation_id":"4a22bc8b-0fad-42f9-9b15-3869fd2ebd12","resolution":{"observed_at":"2026-08-05T04:52:52.414409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:52.136849Z","title":"CamEdit: Continuous camera parameter control for photorealistic image editing","venue":null,"work_id":"7f3ebc56-aff6-4264-a09e-fc689dc64da7","year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:47.544970Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:c072a34521efa72f2924691430bb37b28a0e4ccb622ecd8944ca66a9cb907493","observation_id":"ffe7ae5e-25f0-4752-a5ac-e5ba5ad4723f","resolution":{"observed_at":"2026-08-05T04:52:52.189167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:51.958650Z","title":"Turbo2K: Towards ultra-efficient and high-quality 2K video synthesis","venue":null,"work_id":"9b698827-1562-4fa1-9a96-67ddf3bea222","year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:47.665838Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:5280063de143d74322a9cf89014141c21ce1793f992ded2d3e35a7176b241fc2","observation_id":"508bc7e7-97af-4d74-aec0-5a33ba3fb979","resolution":{"observed_at":"2026-08-05T04:52:52.054813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:51.729033Z","title":"Runway aleph: A new way to edit, transform and generate video.https://runwayml.com/research/ introducing-runway-aleph, 2025","venue":null,"work_id":"6fda5283-fc52-480c-866e-d23d9ebb21b3","year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:47.796789Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:cd46800b062e54bcdeb2946ff2080bd959d5569d487319f21684e966e1d1dbdd","observation_id":"be4fac86-c544-42d1-8513-b8e7d02e35ca","resolution":{"observed_at":"2026-08-05T04:52:51.854025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.04128","last_updated":"2026-05-20T08:56:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T15:49:47Z","title":"JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.04128","snapshot_observed_at":"2026-08-05T04:52:47.955953Z","title":"Awaking spatial intelligence in unified multimodal understanding and generation.arXiv preprint arXiv:2605.04128, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:47.955953Z"},"links":{"cited_paper":"/paper/2605.04128","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:f77f310a5248c2f84812bcd8a94cae52c5655e9a4d9f7212edb7019707b5956a","observation_id":"a1d9831c-9b66-4733-8cff-bafcf06a1d28","resolution":{"observed_at":"2026-08-05T04:52:47.955953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13211","last_updated":"2025-05-19T14:58:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-19T14:58:50Z","title":"MAGI-1: Autoregressive Video Generation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13211","snapshot_observed_at":"2026-08-05T04:52:48.150969Z","title":"Magi-1: Autoregressive video generation at scale.arXiv preprint arXiv:2505.13211, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:48.150969Z"},"links":{"cited_paper":"/paper/2505.13211","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:604f6f918310d59a172432081c218c687716cb77698dca403d79c142fdeb8c8e","observation_id":"ea6b6f20-90f2-4ee0-810d-ea632e536aa2","resolution":{"observed_at":"2026-08-05T04:52:48.150969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.26740","last_updated":"2026-07-13T08:24:23Z","snapshot_observed_at":"2026-08-02T18:32:08.335509Z","submitted_at":"2026-06-25T08:24:03Z","title":"LiveEdit: Towards Real-Time Diffusion-Based Streaming Video Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.26740","snapshot_observed_at":"2026-08-05T04:52:48.357234Z","title":"Liveedit: Towards real-time diffusion-based streaming video editing","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:48.357234Z"},"links":{"cited_paper":"/paper/2606.26740","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:401a26cc6ee1ad0a74a6eb72e4f4fd268389ce7c64fd729472606ef555d0a915","observation_id":"b089cff5-d530-4371-8b9e-05170215929c","resolution":{"observed_at":"2026-08-05T04:52:48.357234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08377","last_updated":"2026-07-03T16:46:11Z","snapshot_observed_at":"2026-08-07T16:29:46.498912Z","submitted_at":"2025-10-09T16:01:30Z","title":"UniVideo: Unified Understanding, Generation, and Editing for Videos","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.08377","snapshot_observed_at":"2026-08-05T04:52:48.552579Z","title":"Univideo: Unified understanding, generation, and editing for videos.arXiv preprint arXiv:2510.08377, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:48.552579Z"},"links":{"cited_paper":"/paper/2510.08377","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:f9e0cfea529bbaa94b9cfa9618fa75c32a3d4caccf1435ec3325e63ce118cf1f","observation_id":"712e81ca-a89f-4179-ab3c-039df3dce6cf","resolution":{"observed_at":"2026-08-05T04:52:48.552579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:51.524593Z","title":"YOSE: You only select essential tokens for efficient DiT-based video object removal","venue":null,"work_id":"33073ae7-0784-41e1-93fd-d237615a5d44","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:48.727640Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:2b173c85967b8511264d5325c21d1a2a439bc3a58e084504d108ad59a7b037f3","observation_id":"c799af65-d50d-4f97-9358-b78d0f5c2261","resolution":{"observed_at":"2026-08-05T04:52:51.620576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:51.385140Z","title":"Xmax x2.0: Real-time interactive video model.https://xmax.ai/, 2026","venue":null,"work_id":"4955bbc6-4c66-4604-af59-56e7bf313d39","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:48.813470Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:f05da2a78102ce11f52aed96de9e0e311a2029d06bdf32da3b467b6abb06b974","observation_id":"a34425a4-4877-4f27-9fdf-03fc008dd3b4","resolution":{"observed_at":"2026-08-05T04:52:51.453442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.22622","last_updated":"2025-10-13T22:41:26Z","snapshot_observed_at":"2026-07-06T22:30:55.313733Z","submitted_at":"2025-09-26T17:48:24Z","title":"LongLive: Real-time Interactive Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.22622","snapshot_observed_at":"2026-08-05T04:52:48.984508Z","title":"Longlive: Real-time interactive long video generation.arXiv preprint arXiv:2509.22622, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:48.984508Z"},"links":{"cited_paper":"/paper/2509.22622","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:603ccaffd817849786a9072574a7c2a53a4617fa319a5b0c6db41641e84ff59a","observation_id":"3e975b9e-bac6-45fe-9d56-448cff17f666","resolution":{"observed_at":"2026-08-05T04:52:48.984508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04216","last_updated":"2025-06-04T17:57:43Z","snapshot_observed_at":"2026-08-08T15:17:23.629862Z","submitted_at":"2025-06-04T17:57:43Z","title":"UNIC: Unified In-Context Video Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04216","snapshot_observed_at":"2026-08-05T04:52:49.121220Z","title":"Unic: Unified in-context video editing.arXiv preprint arXiv:2506.04216, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:49.121220Z"},"links":{"cited_paper":"/paper/2506.04216","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:2f5b4433db159093ad96aa0d74a1c00d754d93c5306fca91cca0c3a45c8411cc","observation_id":"7e7b3924-9277-4b4b-9025-b909113a9592","resolution":{"observed_at":"2026-08-05T04:52:49.121220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:51.184968Z","title":"Improved distribution matching distillation for fast image synthesis.Advancesin neural information processing systems, 37:47455–47487, 2024","venue":null,"work_id":"7fd8f7d9-6045-47a1-9f20-c917840ee10a","year":2024},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:49.246043Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:06814aef7ebd374803ea7aa862dde444e003d26a6fbdb4f07e210b59e1d24714","observation_id":"5c1bb7ca-dfec-4c10-9ba5-3898b981071d","resolution":{"observed_at":"2026-08-05T04:52:51.280637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:50.989566Z","title":"T., Durand, F., Shechtman, E., and Huang, X","venue":null,"work_id":"fee7a28c-bbe5-455c-b0fd-9f1d80bf0262","year":2025},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:49.388817Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:787c2d010b0f099429f2c52ddd55eb995e457c43af457e7c2991c8ea0c98e92b","observation_id":"d663ca78-aa9e-4d35-9a3b-a3fbadeb4dd0","resolution":{"observed_at":"2026-08-05T04:52:51.076850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:52:49.502924Z","title":"Helios: Real real-time long video generation model","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:49.502924Z"},"links":{"citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:def47015fbb72d0379de9d3b97668eb68eabf03cfc36c279fb508cd737f14566","observation_id":"d873010f-fe49-4e6a-8e10-70c3af33f7c2","resolution":{"observed_at":"2026-08-05T04:52:49.502924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.03118","last_updated":"2026-07-21T13:03:04Z","snapshot_observed_at":"2026-08-10T23:56:53.588061Z","submitted_at":"2026-07-03T08:58:06Z","title":"Vidu S1: A Real-Time Interactive Video Generation Model","version":2},"cited_work":{"arxiv_id":"2607.03118","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.03118","snapshot_observed_at":"2026-08-05T04:52:50.130247Z","title":"Vidu S1: A Real-Time Interactive Video Generation Model","venue":"cs.CV","work_id":"e2fbb4bc-6939-4266-847d-fc26bd69671b","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:49.585526Z"},"links":{"cited_paper":"/paper/2607.03118","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:47570c3138751688fe8e57652f08c3d3a57a95f5741ad6f6d5c926e1e2c91a9e","observation_id":"8c4e5496-cf18-4387-9ff8-e09321f7374c","resolution":{"observed_at":"2026-08-05T04:52:50.219179Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30409","last_updated":"2026-05-28T17:59:17Z","snapshot_observed_at":"2026-08-01T22:42:27.290993Z","submitted_at":"2026-05-28T17:59:17Z","title":"SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer","version":1},"cited_work":{"arxiv_id":"2605.30409","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.30409","snapshot_observed_at":"2026-08-05T04:52:49.910330Z","title":"SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer","venue":"cs.CV","work_id":"ce9f77a1-4094-4d73-9aff-534c7c4c1c59","year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:49.671453Z"},"links":{"cited_paper":"/paper/2605.30409","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:10d0ede56b6ee74f51cc13e3fa068aacd17deb487646ff18c873a5d98affbe6a","observation_id":"c1b74f57-7404-434d-a45b-9ec2448a7024","resolution":{"observed_at":"2026-08-05T04:52:50.019014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02214","snapshot_observed_at":"2026-08-05T04:52:49.796613Z","title":"Causal forcing: Autoregressive diffusion distillation done right for high-quality real-time interactive video generation.arXiv preprint arXiv:2602.02214, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T04:52:49.796613Z"},"links":{"cited_paper":"/paper/2602.02214","citing_paper":"/paper/2608.03974"},"observation_digest":"sha256:a1eee628b40f21047c6010d302244973529111bd8657cccdb2da000f04e50f64","observation_id":"60ba23e5-e759-483f-97e7-92be47552989","resolution":{"observed_at":"2026-08-05T04:52:49.796613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03974","last_updated":"2026-08-04T17:40:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T23:12:45.946866Z","submitted_at":"2026-08-04T17:40:48Z","title":"JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":3,"verified_fuzzy":18},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2608.03974."}