{"as_of":"2026-08-04T22:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0e9d825ab505500cc5f853491f71ef29d953b6af6b4648cd3b9a72d8b2e63b73","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":69,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T21:59:31.321644Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-14T18:42:02.940250Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2503.21755"},"observation_digest":"sha256:bf38ff3d8dab852770978adc7035b945f475f66dc5f85b9710e7160bc3cf32af","observation_id":"920a82e0-214c-4678-a179-f6e5abbeb42f","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2504.13074","last_updated":"2025-04-21T10:34:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-17T16:37:27Z","title":"SkyReels-V2: Infinite-length Film Generative Model","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-14T20:23:04.022599Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2504.13074"},"observation_digest":"sha256:3af6d3db29f75a0aab14056c91964808a18efe914c805b2fc94558c7ac302c48","observation_id":"b70c8b50-d6b8-4f14-bb12-5369d0d7d7b7","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2505.11709","last_updated":"2026-03-09T06:44:42Z","snapshot_observed_at":"2026-07-06T21:25:23.371749Z","submitted_at":"2025-05-16T21:34:47Z","title":"EgoDex: Learning Dexterous Manipulation from Large-Scale Egocentric Video","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T15:40:29.361187Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2505.11709"},"observation_digest":"sha256:5c8541886a20a99e4999f6474aa93704304df1cd95e71d7f666219cf5b24087f","observation_id":"904c4401-3050-4138-8152-0c72e9d742a2","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2510.02283","last_updated":"2025-10-02T17:55:42Z","snapshot_observed_at":"2026-08-02T07:40:05.046770Z","submitted_at":"2025-10-02T17:55:42Z","title":"Self-Forcing++: Towards Minute-Scale High-Quality Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T22:39:53.995700Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2510.02283"},"observation_digest":"sha256:4cdcc8f16dc349d602b5f9d3d465b376807a147b618fd368227f83238a2b3f0e","observation_id":"1075809d-a8ea-44af-84bc-b76411acc859","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-03T21:59:31.321644Z","title":"Open-sora 2.0: Training a commercial-level video genera- tion model in $200k.arXiv preprint arXiv:2503.09642, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.12940","last_updated":"2026-07-27T04:39:47Z","snapshot_observed_at":"2026-08-04T14:58:42.988621Z","submitted_at":"2025-11-17T03:47:12Z","title":"Recurrent Autoregressive Diffusion: Global Memory Meets Local Attention","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T21:59:31.321644Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2511.12940"},"observation_digest":"sha256:07c9008833469f0320da9f2b66efc86c9e50c05f9989f12665f1f0d074aa591e","observation_id":"ba6da576-ed99-4693-9004-51229ef2a01c","resolution":{"observed_at":"2026-08-03T21:59:31.321644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2512.02826","last_updated":"2026-04-10T06:54:03Z","snapshot_observed_at":"2026-07-30T04:40:51.868176Z","submitted_at":"2025-12-02T14:34:10Z","title":"From Navigation to Refinement: Revealing the Two-Stage Nature of Flow-based Diffusion Models through Oracle Velocity","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-17T02:26:03.356487Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2512.02826"},"observation_digest":"sha256:b81dd9925f6ce65805f545a9fb4833ab9d74ac8e0e9fc7af031fc7f544096557","observation_id":"83b8f0f0-54a2-4d43-a049-3ff7067711b1","resolution":{"observed_at":"2026-05-17T02:28:53.310062Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2512.10248","last_updated":"2026-05-07T00:10:41Z","snapshot_observed_at":"2026-07-06T22:38:40.044448Z","submitted_at":"2025-12-11T03:12:56Z","title":"RobustSora: De-Watermarked Benchmark for Robust AI-Generated Video Detection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T23:13:02.040618Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2512.10248"},"observation_digest":"sha256:00ae11c745e0ddbec5ad9da425b2d0441f5843a4efad2b3e8e9ec2d3a36176d0","observation_id":"c35fe64a-43ae-4b79-8ce2-70fc044b5c3d","resolution":{"observed_at":"2026-05-16T23:13:39.343438Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2512.13281","last_updated":"2026-05-07T09:33:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-15T12:41:23Z","title":"VideoASMR-Bench: Can AI-Generated ASMR Videos Fool VLMs and Humans?","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T21:46:43.353305Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2512.13281"},"observation_digest":"sha256:e2ffe5d055093965d9c208caeb3d90a4a0ef4a3088a25c2617c8f487e9ae0123","observation_id":"11369396-e682-4676-a599-25ef3bac7ed1","resolution":{"observed_at":"2026-05-16T21:48:34.447730Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2512.22317","last_updated":"2026-05-14T09:46:31Z","snapshot_observed_at":"2026-07-06T22:40:07.339525Z","submitted_at":"2025-12-26T12:06:29Z","title":"LangPrecip: Language-Aware Multimodal Precipitation Nowcasting","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-16T19:13:50.065004Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2512.22317"},"observation_digest":"sha256:686779607c9ec15781efcb01b8a6a039552256e5b61b623db65653dfab7a8ace","observation_id":"2ce84a30-86d7-4fed-b502-27154a54e225","resolution":{"observed_at":"2026-05-16T19:18:19.613163Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2602.04939","last_updated":"2026-05-08T16:47:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-04T16:47:37Z","title":"SynthForensics: Benchmarking and Evaluating People-Centric Synthetic Video Deepfakes","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T07:32:30.580643Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2602.04939"},"observation_digest":"sha256:ca8bf8ef0d2284ed00a0c1f8b0015a2fb3df0431fc6c381b6a42cba51a1f0915","observation_id":"56a81a38-911b-446a-9ef0-8a1a222faf4d","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-03T01:20:05.279081Z","title":"Open-Sora 2.0: Training a commercial-level video generation model in $200 k.arXiv preprint arXiv:2503.09642,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10104","last_updated":"2026-05-26T06:14:19Z","snapshot_observed_at":"2026-08-03T01:20:03.338758Z","submitted_at":"2026-02-10T18:58:41Z","title":"Olaf-World: Orienting Latent Actions for Video World Modeling","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T01:20:05.279081Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2602.10104"},"observation_digest":"sha256:61d255f054322378ad7bd023a115ee90e9dd0028c712784edd55e8b857f34821","observation_id":"56670dff-207b-4700-a755-4fe2b3d1e2b1","resolution":{"observed_at":"2026-08-03T01:20:05.279081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-02T23:23:52.343480Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.13977","last_updated":"2026-06-27T16:11:05Z","snapshot_observed_at":"2026-08-02T23:23:50.481908Z","submitted_at":"2026-02-15T03:48:20Z","title":"WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T23:23:52.343480Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2602.13977"},"observation_digest":"sha256:b21b94e317b026982624f933a402bdd8fe0214a5829b9c8e6ba8fc289cca4e3c","observation_id":"df670900-14ed-456c-b8a7-24ac06e85cfc","resolution":{"observed_at":"2026-08-02T23:23:52.343480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-15T13:50:51.666642Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06453","last_updated":"2026-06-01T03:19:19Z","snapshot_observed_at":"2026-07-15T13:50:49.552763Z","submitted_at":"2026-03-06T16:43:44Z","title":"Pinterest Canvas: Large-Scale Image Generation at Pinterest","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-15T13:50:51.666642Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2603.06453"},"observation_digest":"sha256:cc302bceace0f0fd5f70952aef27a7285745aa1dc1b85a309cab7d9f61571698","observation_id":"141dbb9b-642f-4bfd-a13b-fb3072dd6a28","resolution":{"observed_at":"2026-07-15T13:50:51.666642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2603.08403","last_updated":"2026-05-21T13:59:14Z","snapshot_observed_at":"2026-07-06T22:48:21.803560Z","submitted_at":"2026-03-09T14:00:36Z","title":"SPIRAL: Self-Evolving Action-Conditioned Video Generation via Reflective Planning Agents","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T11:14:47.943242Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2603.08403"},"observation_digest":"sha256:aedbd9291c5c07cb1a7d2ea1c4eb84e8c265232d0432e4f8c45dc98c55407a42","observation_id":"83927022-654d-4a02-aa64-b0b897c37e45","resolution":{"observed_at":"2026-05-22T11:16:27.843107Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-03T02:31:02.214524Z","title":"arXiv preprint arXiv:2503.09642 (2025).https://doi.org/10.48550/arXiv.2503.096424","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01207","last_updated":"2026-07-31T06:47:55Z","snapshot_observed_at":"2026-08-04T21:10:40.245714Z","submitted_at":"2026-04-01T17:51:00Z","title":"TRACE: High-Fidelity 3D Scene Editing via Tangible Reconstruction and Geometry-Aligned Contextual Video Masking","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T02:31:02.214524Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.01207"},"observation_digest":"sha256:b6cdeda0da16eaeefc3b2153ed26b9eff54dc11dc4c6eb756426379ad783b6b8","observation_id":"0aa3c1e2-e35c-4899-9bbd-f2546e30f5bc","resolution":{"observed_at":"2026-08-03T02:31:02.214524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.04142","last_updated":"2026-04-05T15:00:29Z","snapshot_observed_at":"2026-07-06T22:53:10.816748Z","submitted_at":"2026-04-05T15:00:29Z","title":"OP-GRPO: Efficient Off-Policy GRPO for Flow-Matching Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T16:46:30.674244Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.04142"},"observation_digest":"sha256:375299a8f9b5292ad1355b30a95e18805eea989de958214e7ad2bf2342a29c92","observation_id":"aab9ee46-f6d8-407c-aee7-f17f71a9266a","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.04335","last_updated":"2026-04-08T20:38:36Z","snapshot_observed_at":"2026-07-06T22:53:20.122451Z","submitted_at":"2026-04-06T01:02:02Z","title":"GENSERVE: Efficient Co-Serving of Heterogeneous Diffusion Model Workloads","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T20:22:20.395250Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.04335"},"observation_digest":"sha256:a99923528871e9a0913f266d12ed43b18ac3019b1af09c996a6815a2a1f36c64","observation_id":"b9f8eb1b-7d91-4f47-bcc7-2c46d222a031","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.06339","last_updated":"2026-04-07T18:17:05Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T18:17:05Z","title":"Evolution of Video Generative Foundations","version":1},"reference_index":176,"source":"pdf_text","source_observed_at":"2026-05-10T18:41:38.616611Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.06339"},"observation_digest":"sha256:b3912e3f56141018172b07e4d11a486d26060403959f6a1f207e4277fca4807b","observation_id":"b31e54c2-6657-4d82-8a3f-cbca3e22d95f","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.10103","last_updated":"2026-04-28T08:33:18Z","snapshot_observed_at":"2026-07-06T22:58:47.599383Z","submitted_at":"2026-04-11T08:54:07Z","title":"Long-Horizon Streaming Video Generation via Hybrid Attention with Decoupled Distillation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T16:10:54.363560Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.10103"},"observation_digest":"sha256:9203a55c8c18baf64f74fab46dee5fb1871f00c4c5f2aaca9b52fabc9b33f5b1","observation_id":"b6d30548-342f-4287-b64b-00776aa4fe7d","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.15299","last_updated":"2026-04-16T17:57:08Z","snapshot_observed_at":"2026-07-06T23:02:53.677687Z","submitted_at":"2026-04-16T17:57:08Z","title":"AnimationBench: Are Video Models Good at Character-Centric Animation?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T11:47:27.131584Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.15299"},"observation_digest":"sha256:27dfc7d88e2dad510de1cd4a283e07d9cc0c88f1d602d71ea2378855bab249fb","observation_id":"4cf769a2-9986-4b0c-81c5-d513fa9d04a3","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.16503","last_updated":"2026-05-19T02:31:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-14T15:09:39Z","title":"Motif-Video 2B: Technical Report","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T15:50:04.001693Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.16503"},"observation_digest":"sha256:7b9cf707ac4d62838ab0075ea96ee51686ce059da6a59ae12b949da9013ecd07","observation_id":"1b3faa60-230a-4423-8022-1faa06d4171f","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.16503","last_updated":"2026-05-19T02:31:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-14T15:09:39Z","title":"Motif-Video 2B: Technical Report","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-21T00:12:23.096146Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.16503"},"observation_digest":"sha256:9add3c1cc577227ff08c36f6fcb31c3d1ab5227e5aa387523d8d4d228395e599","observation_id":"94a61705-8995-44b7-bc9e-7a25f66a2cd3","resolution":{"observed_at":"2026-05-21T00:13:53.007537Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T06:03:06.920592Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:f3f0eea33ddd7789124d023ea31a968551fe2f46c420f4f8f935def9c83c4334","observation_id":"946d4860-acbe-403c-99a5-dd0cf89578d7","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-12T02:52:58.232585Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:0045a3bf12422509934f5da7817109c2a13e6600382b615138a6c7a8f7063402","observation_id":"9933c3d1-a0c6-4b11-8ccf-ee845ac20fe8","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-05T16:47:32.853010Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:496b99b100c7ea186e8e32daa016847e528fe10f58ccd0742a9c92c66300fe7b","observation_id":"11126354-9000-43db-b4ae-9861d0f9ca92","resolution":{"observed_at":"2026-07-05T16:51:14.271205Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.20936","last_updated":"2026-04-22T13:11:21Z","snapshot_observed_at":"2026-07-06T23:07:36.996629Z","submitted_at":"2026-04-22T13:11:21Z","title":"AttentionBender: Manipulating Cross-Attention in Video Diffusion Transformers as a Creative Probe","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-09T22:42:52.758195Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.20936"},"observation_digest":"sha256:f35710fbd549105015d6704e51f8e6d9599d7f4d064f30f3d30a9c6f9fce3890","observation_id":"6d8bab66-7808-4423-8144-6210c2beef50","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2604.24416","last_updated":"2026-04-27T12:45:18Z","snapshot_observed_at":"2026-07-06T23:10:29.508602Z","submitted_at":"2026-04-27T12:45:18Z","title":"Scaling Properties of Continuous Diffusion Spoken Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T03:43:10.132447Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2604.24416"},"observation_digest":"sha256:e9019ee029ffa3bc584a3f49d259ed4230f512d0b8c9747d8dbc4a910c49f8d8","observation_id":"a1d9c5c3-9e5d-44b1-ad84-f8344d642602","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T15:40:03.605239Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:cb2d8183271b433514f30c1f04a3e9f608fd2711df900d04cfa0fd118c50e551","observation_id":"1570e376-bb2e-448c-9943-60816d2cee37","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:02a230cc38519d8b7fa4393b4e6224f726412e526cf20a63795ba2771e71c61b","observation_id":"51fd0951-e744-4f08-9daf-4557e8e93091","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.07079","last_updated":"2026-05-08T00:58:16Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T00:58:16Z","title":"Learning Visual Feature-Based World Models via Residual Latent Action","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T01:37:27.658078Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.07079"},"observation_digest":"sha256:4f088647ebc5a46536bf646c32836150d9ed34dfff5ce77d910c5719dcd1b2be","observation_id":"118701a2-2a6e-4b69-901b-6a3744cd4e01","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.10218","last_updated":"2026-05-11T08:58:40Z","snapshot_observed_at":"2026-07-06T23:22:13.774652Z","submitted_at":"2026-05-11T08:58:40Z","title":"Relative Score Policy Optimization for Diffusion Language Models","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-05-12T03:47:42.196931Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.10218"},"observation_digest":"sha256:219e2b4cfd7f12af7f4a94a84a516c956ee55b2366c4ca6850f8403a273e0f4f","observation_id":"03bd7dcb-17c4-4a90-acd7-3d474a8f9e2f","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.15256","last_updated":"2026-05-14T17:52:03Z","snapshot_observed_at":"2026-08-02T12:36:39.540615Z","submitted_at":"2026-05-14T17:52:03Z","title":"ReactiveGWM: Steering NPC in Reactive Game World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T16:32:57.227291Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.15256"},"observation_digest":"sha256:2a374f438899ff7fad0c9cfa0a50ed98d984559b0b926495322d1d57d8f3dc25","observation_id":"968722e2-8690-4763-a087-54b756460ed7","resolution":{"observed_at":"2026-05-19T16:33:08.278587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.18678","last_updated":"2026-05-20T11:14:23Z","snapshot_observed_at":"2026-08-04T16:01:22.114748Z","submitted_at":"2026-05-18T17:18:24Z","title":"Lance: Unified Multimodal Modeling by Multi-Task Synergy","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-20T11:46:52.658984Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.18678"},"observation_digest":"sha256:12c882645365753e7414712e138c811adb1a7084fcaa3afb746abbb27a24e49f","observation_id":"a88d0a11-ea7e-40c9-95ce-2758fe29d4e3","resolution":{"observed_at":"2026-05-20T11:48:14.981357Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.18678","last_updated":"2026-05-20T11:14:23Z","snapshot_observed_at":"2026-08-04T16:01:22.114748Z","submitted_at":"2026-05-18T17:18:24Z","title":"Lance: Unified Multimodal Modeling by Multi-Task Synergy","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-21T07:56:34.034047Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.18678"},"observation_digest":"sha256:79249c75763b5f028c98848d358cac4fa7d33a2acdfeaf0ca63954e85c8f1537","observation_id":"cc3b0bd5-9e00-4cc4-b811-955a4a1ac514","resolution":{"observed_at":"2026-05-21T07:59:50.623503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.25343","last_updated":"2026-05-25T01:57:43Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-25T01:57:43Z","title":"Toward Native Multimodal Modeling: A Roadmap","version":1},"reference_index":184,"source":"pdf_text","source_observed_at":"2026-06-29T22:58:38.610609Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.25343"},"observation_digest":"sha256:810e43ccfdba5a5c91e551d622175d6f3ebdc3c99e7686b9a0c0d3400dcdf2e1","observation_id":"626cd2ad-7a54-4975-89d5-ad0301584915","resolution":{"observed_at":"2026-06-29T23:04:02.002481Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.26244","last_updated":"2026-05-25T18:12:09Z","snapshot_observed_at":"2026-07-06T23:36:06.135765Z","submitted_at":"2026-05-25T18:12:09Z","title":"LongAV-Compass: Towards Unified Evaluation of Minute-Scale Audio-Visual Generation Across T2AV, I2AV, and V2AV","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T22:52:38.330851Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.26244"},"observation_digest":"sha256:c68caedcbd9085a41a89ccb24a2763b40479c72700afd5124309a6db1c4dd762","observation_id":"cb2d84a4-6724-4155-8a49-36619d0b34e0","resolution":{"observed_at":"2026-06-29T22:54:00.790687Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.28132","last_updated":"2026-05-27T08:20:04Z","snapshot_observed_at":"2026-07-06T23:37:45.223562Z","submitted_at":"2026-05-27T08:20:04Z","title":"Which Pretraining Paradigm Better Serves Spatial Intelligence? An Empirical Comparison of Vision-Language and Video Generation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T13:49:45.095377Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.28132"},"observation_digest":"sha256:364ca6aa96c994712ea124b09e3d87f45f9035f964ec4625a1d8fbbb51f891c6","observation_id":"7a52f2f8-3b1c-4d11-bab1-4db4b4c3222f","resolution":{"observed_at":"2026-06-29T13:53:28.696566Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.28691","last_updated":"2026-05-27T16:19:45Z","snapshot_observed_at":"2026-07-06T23:38:14.056361Z","submitted_at":"2026-05-27T16:19:45Z","title":"OSP-Next: Efficient High-Quality Video Generation with Sparse Sequence Parallelism, HiF8 Quantization, and Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T13:06:02.201607Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.28691"},"observation_digest":"sha256:e1551bca0984c0e5c1029bcba3d515668bfeeba4d62fee904b843f6a822d01e6","observation_id":"2c92d4f0-25b2-48a2-9450-0442c9ee4cc7","resolution":{"observed_at":"2026-06-29T13:13:27.491850Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.29509","last_updated":"2026-05-28T07:31:22Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:31:22Z","title":"KGEdit: Ambiguity-Aware Knowledge Graphs for Training-Free Precise Video Generation and Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T08:46:56.390567Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.29509"},"observation_digest":"sha256:d01392daee97045fba909d9bcbcc6da510c2af50f514acbc03c5e2a2fa5c5223","observation_id":"807ed6be-737a-4241-9b93-0c625a155c2e","resolution":{"observed_at":"2026-06-29T08:53:16.137411Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-02T05:10:06.145713Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:909bab97cd1cefdced7ab29f314276717197f62d4d3ca66913f727170e9d94ab","observation_id":"b1d7fa2f-2238-42cd-a960-9ca2d61ab926","resolution":{"observed_at":"2026-06-29T08:03:13.595934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.30346","last_updated":"2026-05-28T17:59:51Z","snapshot_observed_at":"2026-08-04T10:14:05.552405Z","submitted_at":"2026-05-28T17:59:51Z","title":"YoCausal: How Far is Video Generation from World Model? A Causality Perspective","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-29T08:27:03.674229Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.30346"},"observation_digest":"sha256:46b4db5105aafe00a8577e9dbc3558b879e34de3c0329b86e18d318539a10f38","observation_id":"6f8c9d2e-f6a6-448f-9c47-a625c0be4b26","resolution":{"observed_at":"2026-06-29T08:33:15.519319Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.00967","last_updated":"2026-06-07T09:07:27Z","snapshot_observed_at":"2026-07-06T23:41:34.459700Z","submitted_at":"2026-05-31T02:55:05Z","title":"MedSyn2: Flexible Control of 3D CT Generation via Text and Semantically-Defined Segmentation Prompts","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T17:43:27.624762Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.00967"},"observation_digest":"sha256:8a771a3ec4670be0f7b2b9c3e25f69bd087f3bd5c66a3e06f2fc24b2af6c51f5","observation_id":"a4e2be8b-1135-4358-97aa-b5f5fb060b4e","resolution":{"observed_at":"2026-07-01T20:46:14.054958Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.01620","last_updated":"2026-06-01T03:12:23Z","snapshot_observed_at":"2026-07-06T23:42:07.508474Z","submitted_at":"2026-06-01T03:12:23Z","title":"Real-Time Generation of Streamable Talking Portrait Video with Reference-Guided Deep Compression VAEs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T15:41:59.683979Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.01620"},"observation_digest":"sha256:f8114b8e2240ae820127479fafb5e900f1399e6363d0a156fa2a9c254e9d004e","observation_id":"837f0016-0877-4393-a5be-724c0ca2cb0b","resolution":{"observed_at":"2026-07-01T22:06:17.007451Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.01955","last_updated":"2026-06-01T09:14:51Z","snapshot_observed_at":"2026-08-03T02:17:56.167011Z","submitted_at":"2026-06-01T09:14:51Z","title":"WALL-WM: Carving World Action Modeling at the Event Joints","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-28T14:15:14.454649Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.01955"},"observation_digest":"sha256:6ea0dfe0e4a912c4ffac9397ee011185c6414ada0523ab4e296ed6406c9eb45e","observation_id":"8b47b616-e6d6-4758-bd9a-1ada7bea218a","resolution":{"observed_at":"2026-07-01T23:36:22.473839Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.13501","last_updated":"2026-07-02T13:06:12Z","snapshot_observed_at":"2026-07-06T23:52:14.348914Z","submitted_at":"2026-06-11T15:51:10Z","title":"GF-DiT: Scheduling Parallelism for Diffusion Transformer Serving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T05:35:01.339479Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.13501"},"observation_digest":"sha256:fab806be9b14d9b0e4e57f004c0aaf3b5eba74ca226f169d0de66d043dcb2d02","observation_id":"3a69ab0b-796b-47bd-9210-36e2a676aef6","resolution":{"observed_at":"2026-07-03T16:28:39.316893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.13501","last_updated":"2026-07-02T13:06:12Z","snapshot_observed_at":"2026-07-06T23:52:14.348914Z","submitted_at":"2026-06-11T15:51:10Z","title":"GF-DiT: Scheduling Parallelism for Diffusion Transformer Serving","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-03T23:50:39.241880Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.13501"},"observation_digest":"sha256:9782909a9c27bd3c1c4cc9530aaf21614fcce4471dba70f39732eb8b8c200107","observation_id":"4fab64d1-b6f9-436c-bdd0-19076790e55d","resolution":{"observed_at":"2026-07-03T23:59:06.285188Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.16533","last_updated":"2026-07-03T04:30:36Z","snapshot_observed_at":"2026-07-12T13:47:19.539499Z","submitted_at":"2026-06-15T10:37:42Z","title":"Kairos: A Regret-Aware Native World-Action Model Stack for Physical AI","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T04:02:53.110012Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.16533"},"observation_digest":"sha256:6ebba8b7707b3e5408c9cae6d00d4bf5186ac2caecbe35b504a7e3c11eea1be7","observation_id":"384ca304-2255-473d-84ae-1c2fcc520b66","resolution":{"observed_at":"2026-07-03T17:28:44.909797Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.19004","last_updated":"2026-06-17T12:31:44Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T12:31:44Z","title":"Spotlight: Synergizing Seed Exploration and Spot GPUs for DiT RL Post-Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T19:06:16.100762Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.19004"},"observation_digest":"sha256:91f22ce824b0c1ee27b0f004da997e798fefa4183f8f6f72543a89d3cb47a09d","observation_id":"262627b2-7a15-4dd2-babc-b0441e9367f2","resolution":{"observed_at":"2026-07-04T02:49:24.717053Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.22370","last_updated":"2026-06-21T07:39:37Z","snapshot_observed_at":"2026-07-06T23:57:14.069903Z","submitted_at":"2026-06-21T07:39:37Z","title":"Towards Error-Free Long Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T10:49:36.838492Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.22370"},"observation_digest":"sha256:f815e0bab018fe1ab7e3bc9a7af4784949b819e3d4409a143d49240a5a257474","observation_id":"98e6c622-302c-43ca-9095-d582990aa9d6","resolution":{"observed_at":"2026-07-04T08:59:42.124937Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.24829","last_updated":"2026-06-23T17:12:21Z","snapshot_observed_at":"2026-08-03T12:13:18.174737Z","submitted_at":"2026-06-23T17:12:21Z","title":"GeoT2V-Bench: Benchmarking 3D Consistency in Text-to-Video Models via 3D Reconstruction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T00:28:33.734545Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.24829"},"observation_digest":"sha256:7084e92e2a4a12c3266c856b00318c0cea32d61bf1c3f1e59df37bf77b4017b9","observation_id":"6d88a5b1-d84b-4f3b-9f61-cbe0bb4c0e16","resolution":{"observed_at":"2026-07-04T16:29:57.972229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.27277","last_updated":"2026-06-25T16:53:30Z","snapshot_observed_at":"2026-08-01T16:13:22.216977Z","submitted_at":"2026-06-25T16:53:30Z","title":"EO-WM: A Physically Informed World Model for Probabilistic Earth Observation Forecasting","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-26T04:33:24.123761Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.27277"},"observation_digest":"sha256:2785f4795cba1c48c087651794a58320b46a8645a31ab48a2878d00445a97364","observation_id":"684d294d-a131-4311-b92b-c30df5a290d1","resolution":{"observed_at":"2026-07-04T14:09:52.642440Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.27374","last_updated":"2026-06-25T17:59:56Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:59:56Z","title":"World Action Models Enable Continual Imitation Learning with Recurrent Generative Replays","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:26.522615Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.27374"},"observation_digest":"sha256:d1d6e750b992fc53eb5ada567f3d4319af60f5a315abd9f1c8496c7ed89f4971","observation_id":"d4a2e50a-2ca5-4621-b6fe-8b29bc80f1f1","resolution":{"observed_at":"2026-07-04T14:19:53.503584Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-02T10:00:07.442935Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-29T02:03:45.564122Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:4a39756def9967b8e69ee6a530243137cdd5e2ce9820ecb55394686369a8fd8e","observation_id":"4ce232f0-eaff-45c0-b19f-d20d22452b3c","resolution":{"observed_at":"2026-07-01T18:25:57.721957Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-02T10:00:07.442935Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-01T06:25:58.872140Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:1c1f33ecc5b7e7cb96b5115b215ba051254c28fe7c473e325f2e6ad8aebb4348","observation_id":"06afcf1b-ad8e-4b2d-849d-e7a2d86d81ed","resolution":{"observed_at":"2026-07-01T09:35:40.547700Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-02T10:00:07.442935Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-02T20:52:28.444524Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:9b8c87ef967e362914b5a2a359a2b63cb6d5dea39881aee6498f2ce4c89ae10d","observation_id":"b2cf2076-34ae-4fe9-8eee-b7d630d9d4f3","resolution":{"observed_at":"2026-07-02T20:57:22.808946Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-02T10:00:07.442935Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-03T22:44:16.272541Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:ae6738e71f2d6edb29261b2979621d60660071f8888a0e9e53750aa52da9d487","observation_id":"1d64e2e9-e152-4d6a-bca9-23f7e294a059","resolution":{"observed_at":"2026-07-03T22:49:00.938974Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-14T17:14:19.770867Z","title":"arXiv preprint arXiv:2503.09642 (2025) 1, 3, 10, 11, 14, S2, S3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-02T10:00:07.442935Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-14T17:14:19.770867Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:b517850b7bed3600583c0ba05812712b272179d446f7648d77cf0e965f1bd87f","observation_id":"5123804f-f60e-42ba-af06-a2a1d71686e9","resolution":{"observed_at":"2026-07-14T17:14:19.770867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-02T10:00:13.451131Z","title":"arXiv preprint arXiv:2503.09642 (2025) 1, 3, 10, 11, 14, S2, S3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-02T10:00:07.442935Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":6},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T10:00:13.451131Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:17362576a21ae74f46b71da2be60d9e2c0bcc20ebadc016e45bc9f89947c1358","observation_id":"9f3e3eb2-9343-40e5-92c4-54410ed9ef62","resolution":{"observed_at":"2026-08-02T10:00:13.451131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-12T09:35:12.908124Z","title":"arXiv preprint arXiv:2503.09642 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02584","last_updated":"2026-07-11T01:46:15Z","snapshot_observed_at":"2026-07-31T15:17:25.423215Z","submitted_at":"2026-07-01T02:44:10Z","title":"RotateAttention: RoPE-Aware Rotation and Range Rectification for INT4 Quantized Attention in Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T09:35:12.908124Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.02584"},"observation_digest":"sha256:947ab1519bec75478d87a2eacb78e5b8ce97a74a2ec7661232ef541a8a08e6d4","observation_id":"9723408a-818d-47a4-b84c-2c8026a007f6","resolution":{"observed_at":"2026-07-12T09:35:12.908124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-14T16:53:34.398685Z","title":"arXiv preprint arXiv:2503.09642 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02584","last_updated":"2026-07-11T01:46:15Z","snapshot_observed_at":"2026-07-31T15:17:25.423215Z","submitted_at":"2026-07-01T02:44:10Z","title":"RotateAttention: RoPE-Aware Rotation and Range Rectification for INT4 Quantized Attention in Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T16:53:34.398685Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.02584"},"observation_digest":"sha256:44b10279255b5193293212c921511cbe284094e6d1cd0457aca25a14308dc7b5","observation_id":"38d1292a-0170-44c4-bcb6-94e0867b0276","resolution":{"observed_at":"2026-07-14T16:53:34.398685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-07-14T09:19:00.292691Z","title":"Open-sora 2.0: Training a commercial- level video generation model in $200k,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10781","last_updated":"2026-07-12T14:17:42Z","snapshot_observed_at":"2026-08-03T07:39:39.842117Z","submitted_at":"2026-07-12T14:17:42Z","title":"Is Energy Guidance All You Need? Training-Free Norm Injection for Driving World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T09:19:00.292691Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.10781"},"observation_digest":"sha256:3f74340160038dbfb6ff6c2feadf39da7597fbb26c6b27bd0005437779a12504","observation_id":"e3a1f9b2-1935-4a7e-8c5f-539b545053e4","resolution":{"observed_at":"2026-07-14T09:19:00.292691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-02T05:32:35.408849Z","title":"Open-sora 2.0: Training a commercial-level video generation model in 200k","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13336","last_updated":"2026-07-14T23:50:57Z","snapshot_observed_at":"2026-08-04T17:00:35.224060Z","submitted_at":"2026-07-14T23:50:57Z","title":"Delving into the Temporal Challenges of Unified Video Protection Against Image-to-Video and Fine-Tuning-based Customization","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T05:32:35.408849Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.13336"},"observation_digest":"sha256:18f36e8c94d4737df0a25a6314503f349a6a9f7f38206cb225cbebb4a7bb2aac","observation_id":"af252ccc-095f-40ad-af6d-a61b8033e6f9","resolution":{"observed_at":"2026-08-02T05:32:35.408849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-02T05:11:09.835348Z","title":"Open-sora 2.0: Training a commercial-level video generation model in $200 k","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13460","last_updated":"2026-07-15T05:44:10Z","snapshot_observed_at":"2026-08-02T05:11:01.779655Z","submitted_at":"2026-07-15T05:44:10Z","title":"LPM: Industrial-Scale Generative Video Restoration","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T05:11:09.835348Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.13460"},"observation_digest":"sha256:375472254238ce447a5bf66dc57c7b1f8cc9c40000f0f35b1de453b954be34cd","observation_id":"33d9ae6e-62e1-4d9b-971e-ebb47ab9728b","resolution":{"observed_at":"2026-08-02T05:11:09.835348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-02T03:10:20.830883Z","title":"Open-Sora 2.0: Training a commercial-level video generation model in $200k.arXiv preprint arXiv:2503.09642,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14194","last_updated":"2026-07-15T16:26:09Z","snapshot_observed_at":"2026-08-02T03:10:20.004502Z","submitted_at":"2026-07-15T16:26:09Z","title":"Inference-Time Concept Suppression and Video-Centric Evaluation for Text-to-Video Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T03:10:20.830883Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.14194"},"observation_digest":"sha256:abf22be8941c3c3566f8d47764e1285f44b8bce5e560e3ad0bbc0e49c8f07ff8","observation_id":"dd0e7d42-f455-4c15-8301-e8f7634e5fec","resolution":{"observed_at":"2026-08-02T03:10:20.830883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-02T03:10:20.833689Z","title":"URLhttps://arxiv.org/abs/2503.09642","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14194","last_updated":"2026-07-15T16:26:09Z","snapshot_observed_at":"2026-08-02T03:10:20.004502Z","submitted_at":"2026-07-15T16:26:09Z","title":"Inference-Time Concept Suppression and Video-Centric Evaluation for Text-to-Video Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T03:10:20.833689Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.14194"},"observation_digest":"sha256:9a56782b0f99e74b82e04ee5fc625707cf3c851ae9d0b9e4b784809846a50265","observation_id":"a8d52b6c-0528-40ae-a657-ef4b2cac58db","resolution":{"observed_at":"2026-08-02T03:10:20.833689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-01T19:06:40.515880Z","title":"arXiv preprint arXiv:2503.09642 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17097","last_updated":"2026-07-19T06:41:53Z","snapshot_observed_at":"2026-08-01T19:06:10.554986Z","submitted_at":"2026-07-19T06:41:53Z","title":"HarmoHOI: Harmonizing Appearance and 3D Motion for Multi-view Hand-Object Interaction Synthesis","version":1},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-08-01T19:06:40.515880Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.17097"},"observation_digest":"sha256:425b3a9fa8935b8e56f59fb48f3f420af55e3ced41e4a762e760c60ce2991463","observation_id":"bbfc114a-6312-4c88-a10f-0127a4deedd6","resolution":{"observed_at":"2026-08-01T19:06:40.515880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-01T18:33:04.930353Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17279","last_updated":"2026-07-19T14:52:31Z","snapshot_observed_at":"2026-08-01T18:33:02.333809Z","submitted_at":"2026-07-19T14:52:31Z","title":"Between Safe Boundaries: Exploiting Temporal Consistency for Jailbreaking Text-To-Video Generation Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T18:33:04.930353Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.17279"},"observation_digest":"sha256:e7ed7618a6767f036f456bea40dc02a81660a02ba87fd2e6d3e15f7c5fe4f0ac","observation_id":"407caaca-ebf6-46d4-bf8f-815ba5901464","resolution":{"observed_at":"2026-08-01T18:33:04.930353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-01T14:02:16.807981Z","title":"Open-sora 2.0: Training a commercial-level video generation model in $200 k.arXiv preprint arXiv:2503.09642, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-03T22:28:45.317805Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:16.807981Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:6eb41f13a1fbc66c1f33c2042651c4aaa70b0dc4e9820009ccf7c92580c480f0","observation_id":"acfafd34-ebcd-4684-8db1-d275f6af47c1","resolution":{"observed_at":"2026-08-01T14:02:16.807981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-01T07:09:10.371272Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21553","last_updated":"2026-07-23T17:36:05Z","snapshot_observed_at":"2026-08-01T22:42:28.999422Z","submitted_at":"2026-07-23T17:36:05Z","title":"SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T07:09:10.371272Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.21553"},"observation_digest":"sha256:620ec9f9afc6c67e931ecc48c03adaaa5c53eceb8a6562b8801b2bde03708ee5","observation_id":"9f939f6d-c5fb-4c6e-92dd-4cef37750e66","resolution":{"observed_at":"2026-08-01T07:09:10.371272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.09642/citation-record","integrity":"/paper/2503.09642/integrity","json":"/paper/2503.09642/citation-record.json","paper":"/paper/2503.09642"},"outbound":[],"paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","latest_version":3,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 69 inbound Pith citation observations for arXiv:2503.09642."}