{"as_of":"2026-08-07T06:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4659c2a720e9a2c6498063b007b501c2b39588a755153ed4afbae08379830cc3","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T19:08:41.963746Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T00:25:30.124004Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04443","snapshot_observed_at":"2026-08-02T00:25:30.124004Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency, July 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15038","last_updated":"2026-07-17T01:17:33Z","snapshot_observed_at":"2026-08-05T07:18:27.558342Z","submitted_at":"2026-07-16T14:19:42Z","title":"Video = World + Event Stream","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T00:25:30.124004Z"},"links":{"cited_paper":"/paper/2607.04443","citing_paper":"/paper/2607.15038"},"observation_digest":"sha256:79ea8de531eb7a7aa7b68f4f62abf93ef339e581f71124886092889bc31ea134","observation_id":"cac9b269-50f3-4690-97cb-abd88f0f8b8f","resolution":{"observed_at":"2026-08-02T00:25:30.124004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.04443/citation-record","integrity":"/paper/2607.04443/integrity","json":"/paper/2607.04443/citation-record.json","paper":"/paper/2607.04443"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.25041","last_updated":"2026-06-29T05:06:50Z","snapshot_observed_at":"2026-07-06T23:59:32.831481Z","submitted_at":"2026-06-23T18:01:03Z","title":"Wan-Streamer v0.1: End-to-end Real-time Interactive Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.25041","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Wan-Streamer v0.1: End-to-end Real-time Interactive Foundation Models, June 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2606.25041","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:d235706af00177fbb43fbf4a7ac6e9ada52363ab97e0d2637d70c07872aa9081","observation_id":"aca78292-676b-452a-8b2c-6aad7e1f4e30","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"From turn-taking to synchronous dialogue: A survey of full-duplex spoken language models.arXiv preprint arXiv:2509.14515, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:b419b39bc8e0f87156426ed6c88a901a6603140bfafb726c38f3cda6ee477fb9","observation_id":"ee6d4e78-6645-4c49-b162-307cf47dd11a","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Moshi: a speech-text foundation model for real-time dialogue.arXiv preprint arXiv:2410.00037, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:3207c575fbc0ad3ad0677b6e521fe996b1e18fb9d8629fbf28389ba9c305a1d6","observation_id":"14c72fb1-992f-43f0-baa2-af3b6e6c90b7","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Qwen3-omni technical report.arXiv preprint arXiv:2509.17765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:0d61f923d6a5864c2ab6bf85857b66c275ecedff413b6d432a258f437bb2474a","observation_id":"5098dbb1-842a-4927-897f-fbff42892d7e","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27393","last_updated":"2026-04-30T04:05:43Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T04:05:43Z","title":"MiniCPM-o 4.5: Towards Real-Time Full-Duplex Omni-Modal Interaction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27393","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Minicpm-o 4.5: Towards real-time full-duplex omni-modal interaction.arXiv preprint arXiv:2604.27393, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2604.27393","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:7ab505513212624406ff25ae6978c1d49936f3f2f981f29fc65b259d5b233efd","observation_id":"19200cff-1fc9-4aec-9d23-4d4863201cac","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:e162d70255aeaed6aff4c7732feb5b0b70c0d96cfc5971fbb14d10205e6f977d","observation_id":"c86103f0-e798-4d5e-a33f-ca3c03067061","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:81faa19acf8d77ea70a29fda7102eaa4d9ba3f742736f18e8e847cfd60cee608","observation_id":"cdc150f0-3bf8-445d-8146-4a4fadbc5f51","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:1b50f93047c589e4ff21e01968ebbb9d539c201007a780be0c380d617a3f38c9","observation_id":"4f5f071d-030a-42fe-ad26-79d3bc010d91","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10667","last_updated":"2024-10-31T07:43:14Z","snapshot_observed_at":"2026-07-06T18:01:01.206270Z","submitted_at":"2024-04-16T15:43:22Z","title":"VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10667","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Vasa-1: Lifelike audio-driven talking faces generated in real time.arXiv preprint arXiv:2404.10667, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2404.10667","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:d470e6fb41dc7caceffaf52f97b95ad877d4e4afff9f32f5335f847727100588","observation_id":"da9677bb-a446-4705-9658-d7c1e2343a4f","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Streamavatar: Streaming diffusion models for real-time interactive human avatars.arXiv preprint arXiv:2512.22065, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:3ad852a7681d6d7f5b162488b75b73352936b3d1cc7606bd019aa38220edccd9","observation_id":"a0528c04-1000-450f-9245-3c6686b7903b","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Mavid: A multimodal framework for audio-visual dialogue understanding and generation.arXiv preprint arXiv:2512.03034, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:e1a77792355f34acd8673bd33fe7a507d8c4e5e5794c3454377f4aa401fa05a0","observation_id":"37c04481-981f-4a5a-b9ac-661436c382fd","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02879","last_updated":"2024-08-06T01:13:09Z","snapshot_observed_at":"2026-08-05T17:22:02.707336Z","submitted_at":"2024-08-06T01:13:09Z","title":"Body of Her: A Preliminary Study on End-to-End Humanoid Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02879","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Body of her: A preliminary study on end-to-end humanoid agent.arXiv preprint arXiv:2408.02879, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2408.02879","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:0d6a966c071337b86b15532ecb4c56551e2c840ec480c4a9bc17989493813d2b","observation_id":"575a995c-af4c-4d5a-b576-83ba3e0d8f00","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-04T19:27:31.715261Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14509","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Deepspeed ulysses: System optimizations for enabling training of extreme long sequence transformer models.arXiv preprint arXiv:2309.14509, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2309.14509","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:fea9dc5f6e0d504af5b264c8e4825dbbc3431fe1066f3d59da9427bce864a0ad","observation_id":"2ba3e891-906f-4526-8c27-08461b5a0681","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Doubao realtime voice model.https://seed.bytedance.com/en/realtime_voice, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:596623257ca6f64975f316592ea23104dc9b2dc0952ce5da155766da71287e6a","observation_id":"bfb354ee-184c-46af-a907-89290af484d8","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Hello gpt-4o.https://openai.com/index/hello-gpt-4o/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:2a2044ce7b94a6ffd7119f9fe2105004e2656adaf12010afccb60f21207ce128","observation_id":"14000a5a-0e1e-4981-a095-18d9a7d83036","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Introducing evi 3: The world’s most realistic and instructible speech-language model.https://www","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:900c553001b75e62b7f3021af1d4af381b98411ef8f874f099a51f421034e65a","observation_id":"d7cb8866-169e-4517-93f3-749f58daeb16","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23632","last_updated":"2026-04-26T09:46:58Z","snapshot_observed_at":"2026-07-06T23:09:48.137856Z","submitted_at":"2026-04-26T09:46:58Z","title":"Hallo-Live: Real-Time Streaming Joint Audio-Video Avatar Generation with Asynchronous Dual-Stream and Human-Centric Preference Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.23632","snapshot_observed_at":"2026-07-11T19:08:41.963746Z","title":"Hallo-live: Real-time streaming joint audio-video avatar generation with asynchronous dual-stream and human-centric preference distillation.arXiv preprint arXiv:2604.23632, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T19:08:41.963746Z"},"links":{"cited_paper":"/paper/2604.23632","citing_paper":"/paper/2607.04443"},"observation_digest":"sha256:9b4e9e58b72bbb416ac90e8ab4a71527704ea24003572d923a8ffb53bacf5249","observation_id":"a77b9910-fa01-4dbf-870c-fdc352a5dbc3","resolution":{"observed_at":"2026-07-11T19:08:41.963746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04443","last_updated":"2026-07-08T11:37:37Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T21:48:20.745411Z","submitted_at":"2026-07-05T18:05:20Z","title":"Wan-Streamer v0.2: Higher Resolution, Same Latency"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 1 inbound Pith citation observation for arXiv:2607.04443."}