{"as_of":"2026-08-12T17:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5dfac0adbaf3cc82448be886bdeb522393e0682ac4258f247c795a617d94bf36","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:11:58.800999Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T11:10:41.589311Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T09:46:27.912130Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"cited_work":{"arxiv_id":"2506.22298","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.22298","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Outdreamer: Video out- painting with a diffusion transformer","venue":null,"work_id":"10f6d60c-bbdf-45a3-b173-eb254c88922b","year":2025},"citing_paper":{"arxiv_id":"2604.14648","last_updated":"2026-04-16T05:55:11Z","snapshot_observed_at":"2026-08-04T20:10:50.215954Z","submitted_at":"2026-04-16T05:55:11Z","title":"Seen-to-Scene: Keep the Seen, Generate the Unseen for Video Outpainting","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T12:11:52.239116Z"},"links":{"cited_paper":"/paper/2506.22298","citing_paper":"/paper/2604.14648"},"observation_digest":"sha256:d4c7d79a94d44291f15c1f52be4ede5dd0c24047ec19eccbc10cd90a8fc64efb","observation_id":"c96a9d5c-b83b-44ad-9967-a0380e10879c","resolution":{"observed_at":"2026-05-10T12:15:22.103322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"cited_work":{"arxiv_id":"2506.22298","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.22298","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Outdreamer: Video out- painting with a diffusion transformer","venue":null,"work_id":"10f6d60c-bbdf-45a3-b173-eb254c88922b","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"cited_paper":"/paper/2506.22298","citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:5acb0901fd98098385a796bc70ef94f22f9fe34d93deb9bc5cef4f415d1dfe39","observation_id":"74f876d0-af63-4dc5-a260-0805486c5240","resolution":{"observed_at":"2026-05-12T09:46:27.915463Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.22298","snapshot_observed_at":"2026-07-31T11:10:41.589311Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24591","last_updated":"2026-07-27T15:55:08Z","snapshot_observed_at":"2026-08-07T03:34:00.173954Z","submitted_at":"2026-07-27T15:55:08Z","title":"CameraAnything: Refilming Videos with Arbitrary Camera Control","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-31T11:10:41.589311Z"},"links":{"cited_paper":"/paper/2506.22298","citing_paper":"/paper/2607.24591"},"observation_digest":"sha256:071fc5401a278cb834f9686d9bfc3d8c735005e48db17c5355d497671c6d580a","observation_id":"5af4b3fe-3aad-4164-bc39-652d89a65212","resolution":{"observed_at":"2026-07-31T11:10:41.589311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.22298/citation-record","integrity":"/paper/2506.22298/integrity","json":"/paper/2506.22298/citation-record.json","paper":"/paper/2506.22298"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:04.352668Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":"52b8de1c-fa7f-411b-97e8-f3633ed403e4","year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.224574Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:9b7b08238d76357770941fdf5f514fde62806c3be373ff32da06033b48b05f91","observation_id":"237cf441-4bfc-494d-8ce6-eba76da04252","resolution":{"observed_at":"2026-08-06T22:12:04.468224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:04.157975Z","title":"Free-form video inpainting with 3d gated convolution and temporal patchgan","venue":null,"work_id":"4bca0317-23f4-4f71-9b50-9599d20d43fe","year":2019},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.286168Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:1dd0ac7282cd5b12293cfa88498aa30d5ca6a0aaea2350cc995c1c2ec0a0daa6","observation_id":"52d209b6-bf2f-47fa-8216-3f6868f2d4f6","resolution":{"observed_at":"2026-08-06T22:12:04.241195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12793","last_updated":"2023-11-28T08:52:50Z","snapshot_observed_at":"2026-08-04T08:17:54.774738Z","submitted_at":"2023-11-21T18:58:11Z","title":"ShareGPT4V: Improving Large Multi-Modal Models with Better Captions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12793","snapshot_observed_at":"2026-08-06T22:11:53.349432Z","title":"Sharegpt4v: Improving large multi-modal models with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.349432Z"},"links":{"cited_paper":"/paper/2311.12793","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:80eea4f5dbe4af1ee21e0eb92d854c41a5ef2677d4451fdade9a214aa4a046aa","observation_id":"96a34dfb-43ac-43f3-a291-cad0fa80722f","resolution":{"observed_at":"2026-08-06T22:11:53.349432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-06T22:11:53.411894Z","title":"Are we on the right way for evaluating large vision-language models? arXiv preprint arXiv:2403.20330, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.411894Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:7febe4a55d9277e751f4bf206dffd76adaa825a8959003970f741878b80fd306","observation_id":"6307e8a6-95cc-4f72-b628-99b3d983141e","resolution":{"observed_at":"2026-08-06T22:11:53.411894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04325","last_updated":"2024-06-06T17:58:54Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-06-06T17:58:54Z","title":"ShareGPT4Video: Improving Video Understanding and Generation with Better Captions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04325","snapshot_observed_at":"2026-08-06T22:11:53.460393Z","title":"Sharegpt4video: Improving video understand- ing and generation with better captions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.460393Z"},"links":{"cited_paper":"/paper/2406.04325","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:fdbd27fcf73c9cc0ea45100343ce7b3815890edbe6e0036b229998385239670c","observation_id":"9c6f1df4-7b18-491e-9890-07aaa8a4c393","resolution":{"observed_at":"2026-08-06T22:11:53.460393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:03.969422Z","title":"Inout: Diverse image outpainting via gan inversion","venue":null,"work_id":"6b0a2fa4-3591-4a2d-936b-ee87f0bb5f09","year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.520196Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:b2da4be4aaee1bfaa5b703c5bfdd131b29b8900228aa53199aa8249944e55be9","observation_id":"588f4445-a408-45ab-9c83-c088acc5ee78","resolution":{"observed_at":"2026-08-06T22:12:04.048502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:03.791257Z","title":"Complete and temporally consistent video out- painting","venue":null,"work_id":"e2e15238-06eb-4067-b07c-2eb59e5f355c","year":null},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.591936Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:fdba66aaeec52561325601e80f035c9375c5a26f56e877760a378e2d931cbd31","observation_id":"4416d721-c247-42aa-966a-45ba7ea27e04","resolution":{"observed_at":"2026-08-06T22:12:03.862983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T22:11:53.656381Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.656381Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:58f73299e154a2e224430eadc30a8fe03a8e20b7963ac2827506594b00fe5394","observation_id":"d935d410-526f-4618-92e6-864e33bd100a","resolution":{"observed_at":"2026-08-06T22:11:53.656381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:03.623422Z","title":"Hierar- chical masked 3d diffusion model for video outpainting","venue":null,"work_id":"70f85298-48ef-4525-b6e7-6bb841b03d2c","year":2023},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.716294Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:14bab0e81d0052083aaa673eed817601588c13ddd1182f03cd8e494cad844a5b","observation_id":"34dceef9-7f09-4503-8f73-953e0ff2052a","resolution":{"observed_at":"2026-08-06T22:12:03.704045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:03.475143Z","title":"Flow-edge guided video completion","venue":null,"work_id":"7bf14f5c-a25e-4378-be30-9c4a0421e324","year":2020},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.783451Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:e222088332ab289756ffcc5cbb4bc3b7f5131a0c8f27b3d2996a7c4bdf28807e","observation_id":"7edb61a6-7c6d-48ed-994d-8b7ed5a1ff65","resolution":{"observed_at":"2026-08-06T22:12:03.540449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T22:11:53.850561Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.850561Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:78385b03879bab541c46a03cf9dd5cef30c4bccbdcfbdff0afea5f2429c5258c","observation_id":"77314824-8f9a-46ed-93fe-b797f669fcd5","resolution":{"observed_at":"2026-08-06T22:11:53.850561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:53.934155Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.934155Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:1864c4ff2ffa28fd935fdcb3a949e2c4ea532ca39e252135713260d94fe261a6","observation_id":"9d49f87d-b2a7-490b-b716-40bbcb8c1cdc","resolution":{"observed_at":"2026-08-06T22:11:53.934155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:03.315253Z","title":"Proposal-based video com- pletion","venue":null,"work_id":"eb14d7b2-e184-47a8-aba0-94159330f4cb","year":2020},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:53.954459Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:f4d4cb26529b13624a34d34e875335a7f20544f4a3e340c437c00cdcc9d79488","observation_id":"e43eca5a-f9de-4850-8c39-cf62fb6e2ae1","resolution":{"observed_at":"2026-08-06T22:12:03.391346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17525","last_updated":"2025-03-11T02:16:29Z","snapshot_observed_at":"2026-08-11T07:46:04.646035Z","submitted_at":"2024-02-27T14:07:09Z","title":"Diffusion Model-Based Image Editing: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17525","snapshot_observed_at":"2026-08-06T22:11:54.082033Z","title":"Diffusion model-based image editing: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:54.082033Z"},"links":{"cited_paper":"/paper/2402.17525","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:17939802ae05bfd8dc1b7765a1ba70e2e15667cea0e4d71455427d06ea591a54","observation_id":"67f68212-a9bb-4e80-80ca-06439b9f1a2f","resolution":{"observed_at":"2026-08-06T22:11:54.082033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:03.106650Z","title":"Open-sora-plan, 2024","venue":null,"work_id":"9a7d2726-d064-4123-9710-bd3372046856","year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:54.169740Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:dfeb3957c0c23fb88a58ad6046330001b1748e35142bad5e48da18896c749c23","observation_id":"d0e10b59-2b14-44d2-89ed-dfbce8d3e418","resolution":{"observed_at":"2026-08-06T22:12:03.216407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:02.908333Z","title":"Srinpaintor: When super-resolution meets transformer for image inpainting","venue":null,"work_id":"f16cc56b-c9fb-4c4f-bbc9-b9ae2108067c","year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:54.299434Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:9dcd4887dc5c28ef7ff12c008c725622b965f3537253ab671dc36c1fab6bfc48","observation_id":"25a7fce3-6b98-4a6e-914e-cfc57f7f54e5","resolution":{"observed_at":"2026-08-06T22:12:02.993378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10207","last_updated":"2024-10-14T07:03:14Z","snapshot_observed_at":"2026-07-06T19:32:51.287674Z","submitted_at":"2024-10-14T07:03:14Z","title":"MagicEraser: Erasing Any Objects via Semantics-Aware Control","version":1},"cited_work":{"arxiv_id":"2410.10207","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.10207","snapshot_observed_at":"2026-08-06T22:11:59.144678Z","title":"MagicEraser: Erasing Any Objects via Semantics-Aware Control","venue":"cs.CV","work_id":"7db9cb60-e76a-4f2c-b8ec-e2ef522e4d72","year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:54.456051Z"},"links":{"cited_paper":"/paper/2410.10207","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:57be0dd5fa7410d10de4db5b36676a48e8168d3bcaf04b672e9e302fc8c741d3","observation_id":"1ae2d5ec-407c-4697-a2ab-8ab1e4ef9951","resolution":{"observed_at":"2026-08-06T22:11:59.229350Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:02.719192Z","title":"Context-aware semantic inpainting.IEEE Trans- actions on Cybernetics, 49(12):4398–4411, 2018","venue":null,"work_id":"6be107ea-627f-4e19-a70e-b1f4aa8cfcc2","year":2018},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:54.622209Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:8ac17108da141187317b5d08d2a2a0f6e485f619d8e6f0347c84f1b8ce58f4ca","observation_id":"cd8d0128-4a81-4073-8f0e-a64e08a7fd33","resolution":{"observed_at":"2026-08-06T22:12:02.801412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:02.535643Z","title":"Mat: Mask-aware transformer for large hole im- age inpainting","venue":null,"work_id":"a9fb3ef8-eb7a-4264-881f-f38a2b11c371","year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:54.750428Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:f4fbe27ec5755d4b7b2c79f439fff487916f05e14037dbbb2f52fb9c746750d9","observation_id":"f284044d-09fb-4862-b9d6-e8aa71731e8c","resolution":{"observed_at":"2026-08-06T22:12:02.638008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:02.336555Z","title":"Image inpainting via iteratively decoupled probabilistic modeling","venue":null,"work_id":"e4821567-1f3a-4017-a952-3558cc29e7b1","year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:54.892455Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:1a03faa521ded9c568f8b5d2e4f47cb0ceee6df2e4a5fd86c7f36fb012e1fa6c","observation_id":"b0a24e48-a327-4f88-b005-c93e78c90a56","resolution":{"observed_at":"2026-08-06T22:12:02.412007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:02.188607Z","title":"Edge guided progressively generative image outpainting","venue":null,"work_id":"9540893e-ce9e-499f-8101-9338822d723b","year":2021},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:55.036916Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:19db86b7113659d1c492663a2bdc16a0ac2a8f87f79ac44f92b3ca8d790a0bf1","observation_id":"05adadb7-3192-4ad8-a2c5-39b0e849db3e","resolution":{"observed_at":"2026-08-06T22:12:02.258609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:01.995378Z","title":"Fuseformer: Fusing fine-grained information in transformers for video inpainting","venue":null,"work_id":"7711cd02-b85e-488f-a5f4-d5f2ea82b159","year":2021},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:55.192724Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:d29c15c60767055d89244f6e2ced5932773f34f312362b04e87ec6597af39d6d","observation_id":"079ac307-8e6b-4de9-814a-6cfe9d798a63","resolution":{"observed_at":"2026-08-06T22:12:02.069014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:01.831411Z","title":"Coordfill: Efficient high- resolution image inpainting via parameterized coordinate querying","venue":null,"work_id":"94219493-d954-4d45-9ebb-380450837ceb","year":2023},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:55.349033Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:bfee5a1efe81c380892a64cb80913e10333a393579299bfc093603e81de7bfcd","observation_id":"31513d9e-ee49-45b3-8239-f637424aa91a","resolution":{"observed_at":"2026-08-06T22:12:01.890268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14091","last_updated":"2024-03-18T16:48:13Z","snapshot_observed_at":"2026-07-06T17:06:41.478216Z","submitted_at":"2023-12-21T18:09:30Z","title":"HD-Painter: High-Resolution and Prompt-Faithful Text-Guided Image Inpainting with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14091","snapshot_observed_at":"2026-08-06T22:11:55.512772Z","title":"9 Hd-painter: high-resolution and prompt-faithful text-guided image inpainting with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:55.512772Z"},"links":{"cited_paper":"/paper/2312.14091","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:55abb47ae4e02fd209b1db88811e760c07f91abad1c7d7b158994bf9c55e6cea","observation_id":"a928335f-ddd7-43dd-b332-01ebc2bd2445","resolution":{"observed_at":"2026-08-06T22:11:55.512772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:55.652616Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:55.652616Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:70be04fdee4947f85b14c27be7e98cd3b9db99dbe9ab2a768cf0f696a53fc927","observation_id":"879c5484-a341-4d3a-9e62-8fc345f413ab","resolution":{"observed_at":"2026-08-06T22:11:55.652616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:55.804781Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:55.804781Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:88737215008dd553230d72eed433fac0703d1ae2ae73429f8852bf56bc072c60","observation_id":"43c236ac-5ed0-4fae-8163-fbb1c0287ae2","resolution":{"observed_at":"2026-08-06T22:11:55.804781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06070","last_updated":"2025-03-08T08:43:03Z","snapshot_observed_at":"2026-08-12T15:52:52.083305Z","submitted_at":"2024-08-12T11:41:18Z","title":"ControlNeXt: Powerful and Efficient Control for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06070","snapshot_observed_at":"2026-08-06T22:11:55.969723Z","title":"Controlnext: Powerful and effi- cient control for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:55.969723Z"},"links":{"cited_paper":"/paper/2408.06070","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:4e8e24f9355b1b409ce40583adc04b0444820b734ce0d67e0b6c43a5c4632181","observation_id":"5b3a2f64-39ec-42f2-b784-59d16900367d","resolution":{"observed_at":"2026-08-06T22:11:55.969723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:56.199329Z","title":"Fatezero: Fus- ing attentions for zero-shot text-based video editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:56.199329Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:ae200ecb624819734a042df7646cf7927df5a0d98582d4a0e4751ede1eedfd54","observation_id":"e83b1670-3a46-4aeb-a0e9-a63cc6c0a19a","resolution":{"observed_at":"2026-08-06T22:11:56.199329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:01.600953Z","title":"Deep learning-based image and video inpainting: A survey","venue":null,"work_id":"dcec160d-ee18-46a6-a285-59d622cec2df","year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:56.379305Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:89265c52182b6575cc618005abdb1741b152f32db9d2acc48fa8bb2a046336c9","observation_id":"ef8b0bf5-8235-48ba-994d-8b1f1af49f6f","resolution":{"observed_at":"2026-08-06T22:12:01.667367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-06T22:11:56.557476Z","title":"Hierarchical text-conditional image gener- ation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:56.557476Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:584ef6314357c3767bce8354080e537ce7ea3c6809372ecaa8f78486a5ef5c63","observation_id":"ffb8929c-c9a8-4a7f-a986-1cbb9babd25c","resolution":{"observed_at":"2026-08-06T22:11:56.557476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:56.738546Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:56.738546Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:f4ee861e94796edda468b7cbc5940f3e36fb3291016304c07e2c2352448b96a6","observation_id":"278dea5d-5895-429b-84b2-8ee5022cd068","resolution":{"observed_at":"2026-08-06T22:11:56.738546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:01.422148Z","title":"Palette: Image-to-image diffusion models","venue":null,"work_id":"99adec41-845f-44b0-a037-5520641317a8","year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:56.884148Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:3d2df8d2d679df8c62c036f69e8962d48dd52cad3a7166d1e46efccbc4f428f9","observation_id":"c72551ce-2180-486c-bd4a-2555060bac40","resolution":{"observed_at":"2026-08-06T22:12:01.504112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T22:11:57.069570Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:57.069570Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:ba58116b1c406c863ee6673aaf752f49b2648e8776f9046080a2b23e25ed7a4e","observation_id":"6f2fc568-6ebd-412f-8d7b-f768662cd93c","resolution":{"observed_at":"2026-08-06T22:11:57.069570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:57.217028Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:57.217028Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:f8224f226d09f1dd62a0a2c1db339217d9b2c61e5372ff271ba090e5b62a0041","observation_id":"84c12509-96e1-4c96-81bd-b7d2c39fedaf","resolution":{"observed_at":"2026-08-06T22:11:57.217028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:01.183179Z","title":"Resolution-robust large mask inpainting with fourier convolutions","venue":null,"work_id":"0d1288f7-0d3e-4e0c-935c-4f5fbc392581","year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:57.402789Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:f96a8965bc397831e97f0c38b4c24e150e181d9e6b551e1f6272ac03d13d5be1","observation_id":"6688fcf7-4bee-4ad0-9adb-375167d7c410","resolution":{"observed_at":"2026-08-06T22:12:01.274665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:01.021591Z","title":"Be-your-outpainter: Mastering video outpainting through input-specific adaptation","venue":null,"work_id":"158c8950-376b-4991-af22-cd6a2846bda1","year":2025},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:57.530045Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:5a28ab5dad7637f566b9fc0e185a4badcd4f7b05a083990176af1d046b3ee409","observation_id":"1b79a47d-f006-478b-acb9-75ec5fff821b","resolution":{"observed_at":"2026-08-06T22:12:01.096554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17599","last_updated":"2024-01-04T01:30:50Z","snapshot_observed_at":"2026-08-10T14:48:14.307906Z","submitted_at":"2023-03-30T17:59:25Z","title":"Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17599","snapshot_observed_at":"2026-08-06T22:11:57.698875Z","title":"Zero-shot video editing using off-the-shelf image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:57.698875Z"},"links":{"cited_paper":"/paper/2303.17599","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:847badc01e00bd8b7ba27ddc1fc5d3dfad4a9b2fa590fcf05f2035f8bba52edc","observation_id":"3032745f-5e02-4e3d-8dae-dd559607ced8","resolution":{"observed_at":"2026-08-06T22:11:57.698875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:00.863887Z","title":"Sketch-guided scenery image outpainting","venue":null,"work_id":"bd405fa3-7a38-4032-b5d4-e670d84ad9f6","year":2021},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:57.820495Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:b1bfbf0e924217abacefcd492a4db812c5c438109b4882f6a860ff21583297e8","observation_id":"a34a98d4-0067-4b3c-91a7-9f5315655dac","resolution":{"observed_at":"2026-08-06T22:12:00.938713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:57.888125Z","title":"Deep learning for im- age inpainting: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:57.888125Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:74bae882a3354665c1cd4be21cfe52ed71738e7d4f10fc871ef53949920ca411","observation_id":"c00f95c1-bd6a-4d2d-9d3d-7a4a179e791f","resolution":{"observed_at":"2026-08-06T22:11:57.888125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:00.664833Z","title":"Smartbrush: Text and shape guided object inpainting with diffusion model","venue":null,"work_id":"41de109a-d731-4ce8-a9f3-f9d41b7005fb","year":2023},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:57.968906Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:5c2e6022abf66184da99fa500761aefa894ca14d83ae330d57bae6ccaca7ccc0","observation_id":"942a7495-a4ac-4b5b-9ff5-0e9dc4ed0b83","resolution":{"observed_at":"2026-08-06T22:12:00.756061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:00.473395Z","title":"Deep flow-guided video inpainting","venue":null,"work_id":"d3fab79a-1f3c-4f8b-a041-936174a8127a","year":2019},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.040458Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:23ad0d693db85ebe3fe8f2e9e3675bfb39637ae5669917be80346bfe064122fd","observation_id":"1462e931-3758-43f2-98be-739cab7ac0fc","resolution":{"observed_at":"2026-08-06T22:12:00.589954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:00.333156Z","title":"High-resolution image inpainting us- ing multi-scale neural patch synthesis","venue":null,"work_id":"a7d9e2a2-66a8-4452-88b7-9c0618737deb","year":2017},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.113382Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:ec02f6a024a72f60b05dd84de6cb6a3ba2a79b88741160d8458c39a8b431a834","observation_id":"53f6d573-a941-48d4-91f5-0c97d103ab4d","resolution":{"observed_at":"2026-08-06T22:12:00.396922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:12:00.128472Z","title":"Scene graph expansion for semantics-guided image outpainting","venue":null,"work_id":"0d98e2c0-58d6-437d-9461-28911a9f1936","year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.204869Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:a555adcd646ce1cc826ebb247fa54f3d4a51c091e306c601bafdc51281958d98","observation_id":"178dfffb-9cc2-4d88-90de-1ea0f2cb29a8","resolution":{"observed_at":"2026-08-06T22:12:00.222342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:58.334236Z","title":"Uni-paint: A unified framework for multimodal image inpainting with pretrained diffusion model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.334236Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:0eb35d83e4161980e5827dba05cdbe699b343b8427063e629b49965b7f119321","observation_id":"2b2e4195-816e-4af9-bc82-9ca9fb4b3ff8","resolution":{"observed_at":"2026-08-06T22:11:58.334236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:59.920625Z","title":"Flow-guided transformer for video inpainting","venue":null,"work_id":"777e10da-f6e4-435e-9158-3302ba570103","year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.428992Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:e9790186f2c81ad1667fec61be7c5d557abb8fa0e3a2906fc2c8a0728d5a13c2","observation_id":"2e12804d-5c9b-4d27-aca9-1bf5f4385e00","resolution":{"observed_at":"2026-08-06T22:11:59.999335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:59.730482Z","title":"Inertia-guided flow completion and style fusion for video inpainting","venue":null,"work_id":"007251a7-115d-407f-a359-545d4246e810","year":2022},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.490012Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:c637eb4cc6c03392a34b6e01fa02625f52330dd02b2af0f38ac3e60adeb3bafb","observation_id":"0fa21041-8588-45b9-be6f-f22aa8f71edb","resolution":{"observed_at":"2026-08-06T22:11:59.810318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:59.570113Z","title":"Avid: Any-length video inpainting with dif- fusion model","venue":null,"work_id":"2190895e-ae05-4eee-a485-487b9e559fa8","year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.580858Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:1e6c9ad26a8c89eae3251990b2515155e69458f34909d629d613cd29179bc88b","observation_id":"155bc607-ab67-48ab-90a0-9cda1186e79e","resolution":{"observed_at":"2026-08-06T22:11:59.628406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10428","last_updated":"2021-03-18T17:59:11Z","snapshot_observed_at":"2026-08-06T22:56:38.288466Z","submitted_at":"2021-03-18T17:59:11Z","title":"Large Scale Image Completion via Co-Modulated Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10428","snapshot_observed_at":"2026-08-06T22:11:58.653616Z","title":"Large scale image comple- tion via co-modulated generative adversarial networks.arXiv preprint arXiv:2103.10428, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.653616Z"},"links":{"cited_paper":"/paper/2103.10428","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:3528ebd374a1a27cbcdf140ff77800da93ff629d2c8c9edd0ff986f96ebf7b69","observation_id":"a8234854-156d-4aca-8ea7-4e4547418345","resolution":{"observed_at":"2026-08-06T22:11:58.653616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:11:59.412132Z","title":"Propainter: Improving propagation and transformer for video inpainting","venue":null,"work_id":"be728087-61f5-43b9-a3a4-40a122323955","year":2023},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.732396Z"},"links":{"citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:98ffd4cfc6b2baa7292a1c98b54caa7494034c52a2fa7b27255644914c715824","observation_id":"6b633725-ebcb-4171-b31d-2f31681cf598","resolution":{"observed_at":"2026-08-06T22:11:59.467909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12035","last_updated":"2024-03-18T17:59:27Z","snapshot_observed_at":"2026-08-05T17:13:30.746659Z","submitted_at":"2024-03-18T17:59:27Z","title":"CoCoCo: Improving Text-Guided Video Inpainting for Better Consistency, Controllability and Compatibility","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12035","snapshot_observed_at":"2026-08-06T22:11:58.800999Z","title":"Cococo: Improving text-guided video inpainting for better consistency, controllability and compatibility.arXiv preprint arXiv:2403.12035, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.800999Z"},"links":{"cited_paper":"/paper/2403.12035","citing_paper":"/paper/2506.22298"},"observation_digest":"sha256:ba21b860b0fca937d6e0fa0ada6f3d71cfa98e6e3ddc9531323288e1f425ed3f","observation_id":"12722e46-fb9a-47b3-93c2-61baaa4bb68f","resolution":{"observed_at":"2026-08-06T22:11:58.800999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T02:06:14.603220Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 3 inbound Pith citation observations for arXiv:2506.22298."}