{"as_of":"2026-08-07T19:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:457f80eec2b0d30202bedc3c70827da701c519c55e104438c8dacbcc63cf1007","coverage":[{"denominator":83,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":83,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T06:07:34.594968Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05070/citation-record","integrity":"/paper/2608.05070/integrity","json":"/paper/2608.05070/citation-record.json","paper":"/paper/2608.05070"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02800","last_updated":"2026-06-23T17:33:32Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:12:30Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02800","snapshot_observed_at":"2026-08-06T06:07:34.380165Z","title":"Cosmos 3: Omnimodal world models for physical ai.arXiv preprint arXiv:2606.02800, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.380165Z"},"links":{"cited_paper":"/paper/2606.02800","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:2f61b1c85ceff3b9e2a908b1d92d56f07172f269b06b1bb0a08e36dddca58f30","observation_id":"49e6124c-77a7-49d7-acd3-efdae777dd89","resolution":{"observed_at":"2026-08-06T06:07:34.380165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20668","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:21.918315Z","title":"From masks to worlds: A hitchhiker’s guide to world models.arXiv preprint arXiv:2510.20668, 2025","venue":null,"work_id":"9acb8de7-fc96-4137-8ebd-b4afe60e3311","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.384085Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:aa6e3e22c6ee90926f18148b6b8f10f1d1107636086d77111b77d78289006ef4","observation_id":"94c360ca-f68d-4952-8506-972c4c41e27a","resolution":{"observed_at":"2026-08-06T06:08:22.348534Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T06:07:34.386997Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.386997Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:e9109042822370e9ac5324022f68619d431f435de456dfb652b457451377c05b","observation_id":"938e707a-b866-43c4-a692-5ce40ec0f7d5","resolution":{"observed_at":"2026-08-06T06:07:34.386997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.390188Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.390188Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:7ea24f780bdd1b2b07d0082c8d1c08b66d74a7104905fcbecb53b29604c5aeab","observation_id":"62216367-401e-4033-a47b-b4905ae1a015","resolution":{"observed_at":"2026-08-06T06:07:34.390188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.393029Z","title":"Ambigest: A dataset of social gestures with inter-class similarity and intra-class variability","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.393029Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bb7ca7ec8f1927c8ff76e32f2f77a747299483028d05172a8ce5b07fdcf8f7f3","observation_id":"f6b1d309-374f-4d4c-9c78-f8a84d9b8b6e","resolution":{"observed_at":"2026-08-06T06:07:34.393029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.395911Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.395911Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:c6db9b793c48850c9c35f0559c3df8a8000140ffd1c64f8509a77416962228a3","observation_id":"fcd8d50c-e834-4681-bc5f-0e4d31f7232b","resolution":{"observed_at":"2026-08-06T06:07:34.395911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.399002Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.399002Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:5b23c15162507c994a52ce4153f3ee6c4a6451b5b6b1ae29f4736364abb4bef3","observation_id":"6b0f2089-2724-4012-8061-9bf6e070ada4","resolution":{"observed_at":"2026-08-06T06:07:34.399002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.401487Z","title":"Socialgesture: Delving into multi-person gesture understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.401487Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:53506b259d6c928483d10e4fda8b83618a58e8c1dd8797d6dc602ed80718b968","observation_id":"78225e38-a359-4e78-93b9-a3ce07305cb7","resolution":{"observed_at":"2026-08-06T06:07:34.401487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.814250Z","title":"Gamegen-x: Interactive open- world game video generation","venue":null,"work_id":"0dfca0a7-ec87-4456-a66a-d31441eab873","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.404095Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:9331f909fabda43d7c3f0ea7f8bbdf6b731f883a0498b82bd49719adba5216e4","observation_id":"e36edbca-8bf9-4479-8c0d-90010906e44c","resolution":{"observed_at":"2026-08-06T06:08:31.949076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.654215Z","title":"Unils: End-to-end audio-driven avatars for unified listening and speaking","venue":null,"work_id":"2a98d613-3ec7-4c05-9e00-d1e2e3430bcf","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.406801Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:f8b37d0ed7e135c4d6f1aa73bcb689583f4f6ce6f4ec1648bbc8ce417d6ec7e1","observation_id":"4bf46882-81ca-4504-a02f-dc0cf813bd42","resolution":{"observed_at":"2026-08-06T06:08:31.756907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.409421Z","title":"Oasis: A universe in a transformer.URL: https://oasis-model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.409421Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:85b4e0f7dd5272df50c133628d335be10ffc79e14ad51f4a0fb4a247c0be075c","observation_id":"5d846b82-3287-45b6-9fcd-5e511aea2bd2","resolution":{"observed_at":"2026-08-06T06:07:34.409421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.412122Z","title":"Worldscore: A unified evaluation benchmark for world generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.412122Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:f4eb84ad586d19a5d0c77179ed35702a4794a1ad3e68e03b65f2b04957d0915f","observation_id":"70c1c402-76f8-4d31-a264-61c4d2bf33af","resolution":{"observed_at":"2026-08-06T06:07:34.412122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.455365Z","title":"The matrix: Infinite-horizon world generation with real-time moving control.Advances in Neural Information Processing Systems, 38:87318–87344, 2026","venue":null,"work_id":"894cb39b-a654-4876-923a-59b4f3061e83","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.414991Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:0d99cf9da7d236b5bb05404cd127aed439540c8375751a75a9573a40e5841069","observation_id":"d2c52cf2-0f07-4ea2-b81d-d9deced9d262","resolution":{"observed_at":"2026-08-06T06:08:31.562991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.417402Z","title":"Longvie 2: Multimodal controllable ultra-long video world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.417402Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:9811931b0cd4b6b506e37151eaaf6e119431adca9e9641b0054ea4fafb7be09e","observation_id":"c258aff9-ad34-4c42-aa61-3e45aa9aa387","resolution":{"observed_at":"2026-08-06T06:07:34.417402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08388","last_updated":"2025-04-11T09:41:04Z","snapshot_observed_at":"2026-08-07T16:06:34.954758Z","submitted_at":"2025-04-11T09:41:04Z","title":"MineWorld: a Real-Time and Open-Source Interactive World Model on Minecraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08388","snapshot_observed_at":"2026-08-06T06:07:34.419786Z","title":"Mineworld: a real-time and open-source interactive world model on minecraft.arXiv preprint arXiv:2504.08388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.419786Z"},"links":{"cited_paper":"/paper/2504.08388","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:1449922856ea7671ee19cc3713913c2124e20c5b32286b303ef6901f157d2492","observation_id":"0f8eacfb-ad78-4035-8bb8-4993efafaa89","resolution":{"observed_at":"2026-08-06T06:07:34.419786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03233","last_updated":"2026-01-06T18:24:41Z","snapshot_observed_at":"2026-07-06T22:40:51.136169Z","submitted_at":"2026-01-06T18:24:41Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03233","snapshot_observed_at":"2026-08-06T06:07:34.422791Z","title":"Ltx-2: Efficient joint audio-visual foundation model.arXiv preprint arXiv:2601.03233, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.422791Z"},"links":{"cited_paper":"/paper/2601.03233","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:78a4b0ca48d5a8f5abe54ce987efb05f7c2233728445e1ee7be5acdb7529e4cb","observation_id":"f98d0a25-82ee-4045-9fe4-6874ad15e693","resolution":{"observed_at":"2026-08-06T06:07:34.422791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.265236Z","title":"Voyager: Long-range and world-consistent video diffusion for explorable 3d scene generation.ACM Transactions on Graphics (TOG), 44(6):1–15, 2025","venue":null,"work_id":"85224604-bfef-4c5c-83c2-47080c8eb7f2","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.425711Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:6bb63cd3922d8cda6f154e38eb64cfe706ccaeab9d6ef0dc83b76ac5525f6127","observation_id":"c294d5fa-4f9d-446b-99ff-45fab41619d8","resolution":{"observed_at":"2026-08-06T06:08:31.363548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:31.082897Z","title":"Bind-your-avatar: Multi- character-talking video generation with dynamic 3d-mask-based embedding router","venue":null,"work_id":"50f6fca2-8ab1-4621-a16c-2174d2ec568a","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.428485Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:819573384f538bd80433d971735bc77fd33d012cff68fdc170c1ff34b0b1138b","observation_id":"6673ac12-bbc0-46d0-b822-ad6f66cda458","resolution":{"observed_at":"2026-08-06T06:08:31.125282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.430983Z","title":"Can mllms read the room? a multimodal benchmark for assessing deception in multi-party social interactions.arXiv preprint arXiv:2511.16221, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.430983Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:735f0306fd9f532f58b1ecf58cdc763c90a83224225aafcec3fe71716a20084c","observation_id":"34cda8f6-18bd-4085-9b82-815ea5c07e0c","resolution":{"observed_at":"2026-08-06T06:07:34.430983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15764","last_updated":"2026-05-15T09:24:41Z","snapshot_observed_at":"2026-07-06T23:27:01.213106Z","submitted_at":"2026-05-15T09:24:41Z","title":"GRASP: Learning to Ground Social Reasoning in Multi-Person Non-Verbal Interactions","version":1},"cited_work":{"arxiv_id":"2605.15764","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15764","snapshot_observed_at":"2026-08-06T06:08:21.650683Z","title":"GRASP: Learning to Ground Social Reasoning in Multi-Person Non-Verbal Interactions","venue":"cs.CV","work_id":"f1a78571-e2a4-4143-b760-1cb8474dda84","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.433367Z"},"links":{"cited_paper":"/paper/2605.15764","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:abffbb43a40b3927180beda85065cff5421eda1690d0821f2d63cd56307025df","observation_id":"610f178b-cfba-4332-9cb6-591cfccf2fb3","resolution":{"observed_at":"2026-08-06T06:08:21.667996Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.885361Z","title":"Let them talk: Audio-driven multi-person conversational video generation.Advances in Neural Information Processing Systems, 38:70990–71013, 2026","venue":null,"work_id":"f6e6b807-0ecf-4e57-bded-84c113f6e21d","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.436396Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:ea47ab436394b53498ff9f646f267b1868b41e6d9ee3b0bc0772709f30a9a7cb","observation_id":"2c928ef5-900b-4af8-b419-3260bce49e8a","resolution":{"observed_at":"2026-08-06T06:08:30.981789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.439047Z","title":"Modeling multimodal social interactions: new challenges and baselines with densely aligned representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.439047Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:58b6360e336826afd3377ff5585bdbe00fd23015fcb2bb9c5c82daa2505eaedb","observation_id":"db7fbc3f-a25b-4a1c-a7ce-e7566cc6db8a","resolution":{"observed_at":"2026-08-06T06:07:34.439047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.714912Z","title":"Worldmodelbench: Judging video generation models as world models.Advances in Neural Information Processing Systems, 38, 2026","venue":null,"work_id":"a411be38-a80e-4e45-b566-4883f310f1b7","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.441410Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:4a9ac39c4a2230e09ca819afef598ae6f3a55f2549b42ce9247bf4575d8aaadf","observation_id":"1f097e2e-73dc-4608-8b7b-6657338952bd","resolution":{"observed_at":"2026-08-06T06:08:30.811623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17201","last_updated":"2025-06-20T17:50:37Z","snapshot_observed_at":"2026-08-06T23:28:21.347321Z","submitted_at":"2025-06-20T17:50:37Z","title":"Hunyuan-GameCraft: High-dynamic Interactive Game Video Generation with Hybrid History Condition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17201","snapshot_observed_at":"2026-08-06T06:07:34.444046Z","title":"Hunyuan-gamecraft: High-dynamic interactive game video generation with hybrid history condition.arXiv preprint arXiv:2506.17201, 2(3):6, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.444046Z"},"links":{"cited_paper":"/paper/2506.17201","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:309a326b68041a5b4bb20f3aad4ead8b909dea56b9408f353994ed28171d3b0c","observation_id":"7630085e-2c01-4e65-a034-20e628b3473a","resolution":{"observed_at":"2026-08-06T06:07:34.444046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.540054Z","title":"Towards online multi-modal social interaction understanding.Transactions on Machine Learning Research (TMLR), 2026","venue":null,"work_id":"57cd5f7d-0d1f-4c85-a547-2c1b171e6efa","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.446905Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:2d03f3525e5377e610fe57dcaa61c07f8ff02b0c7bc8a6a18ff6a3033aca1a8b","observation_id":"aebb0533-2a6e-49db-8b3e-33e8fe5ef4e6","resolution":{"observed_at":"2026-08-06T06:08:30.654128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.358469Z","title":"Omni-mmsi: Toward identity-attributed social interaction understanding","venue":null,"work_id":"6d4746ef-bbed-4861-888c-51635886a3f3","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.449823Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:75c24172de633cc676e238efe94eb1fdd750d087fd1659f4ce42d8e0f4d8d040","observation_id":"b61c4584-fdfe-4b9b-b723-e8344f09a412","resolution":{"observed_at":"2026-08-06T06:08:30.449487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:30.094912Z","title":"Sekai: A video dataset towards world exploration","venue":null,"work_id":"9e1cc14c-f06b-44e6-86e2-a6e2edb64744","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.452465Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:a210e9ea121c92914396b553304bb7dbac97983f83eb91b338d01ad70663cfa5","observation_id":"2a36068d-0354-49be-97a0-833ced67d20a","resolution":{"observed_at":"2026-08-06T06:08:30.270423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.454896Z","title":"Wildworld: A large-scale dataset for dynamic world modeling with actions and explicit state toward generative arpg.arXiv preprint arXiv:2603.23497, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.454896Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bc187c4b61d197ba99329fc5c4a8e937445fe3fadb585a637e91841cceb3aa55","observation_id":"057c0d93-6a6b-4357-beb5-de094200b9e7","resolution":{"observed_at":"2026-08-06T06:07:34.454896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:29.837430Z","title":"Intergen: Diffusion-based multi- human motion generation under complex interactions.International Journal of Computer Vision, 132(9): 3463–3483, 2024","venue":null,"work_id":"a2e0ddc9-614c-4fc9-8030-781289695543","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.457389Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:535c0fbab7c8acc7802f4d198d49a848c64700026d2789ea2750ec22b2557a23","observation_id":"ed273198-06ff-417e-824e-d77223bda03a","resolution":{"observed_at":"2026-08-06T06:08:29.985229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:29.570380Z","title":"Polyslgen: Online multimodal speaking-listening reaction generation in polyadic interaction","venue":null,"work_id":"11e68f32-9a22-41bc-93a9-7aae9ee8ad93","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.459711Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:b8b6bc7055a8ef9c34244e341bb3c03a40f95ee0f1c9d86af849d50b032e1176","observation_id":"575ff1b3-2819-40b5-983b-48842070529e","resolution":{"observed_at":"2026-08-06T06:08:29.679216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.461925Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.461925Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:f001a912eb91412a785d659fae22633e477c4fda0e20dd1f378d97dff1e58f7a","observation_id":"73afcc6f-6715-450e-9923-521886e2d2d8","resolution":{"observed_at":"2026-08-06T06:07:34.461925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:29.146181Z","title":"Uvagaze: Unsupervised 1-to-2 views adaptation for gaze estimation","venue":null,"work_id":"e09af479-a37d-46e6-9ce8-15c027bfea0f","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.464520Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:a226c01927184681f0ec75842909f99a8cbcec6e6f5d14b30b8f90bd1d6973c3","observation_id":"b9d0db5c-ffbf-42f2-81b0-0e1bb3d06d29","resolution":{"observed_at":"2026-08-06T06:08:29.322043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:28.839002Z","title":"Pnp-ga+: Plug-and-play domain adaptation for gaze estimation using model variants.IEEE Transactions on Pattern Analysis and Machine Intelligence, 46 (5):3707–3721, 2024","venue":null,"work_id":"ce8b9b1d-e354-4a66-8a49-fbaa1f76123d","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.466870Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:56c88dbdd56af5e2cc101875b15b871bfafdd68f9c03ae54c61e71bf9d4fee13","observation_id":"a5afb45d-6680-4a0a-8db2-79d2d17efdaa","resolution":{"observed_at":"2026-08-06T06:08:29.015741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:28.295543Z","title":"Single-to-dual-view adaptation for egocentric 3d hand pose estimation","venue":null,"work_id":"fc883e35-cd86-4ee3-afa1-20386438115e","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.469297Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:76ee5ddba42c2326600ab54783e6f2d274be55af6892d7735a88e7b280b44782","observation_id":"53af6114-5c1e-420f-9d13-7af024036908","resolution":{"observed_at":"2026-08-06T06:08:28.547480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:27.974142Z","title":"Sfhand: A streaming framework for language-guided 3d hand forecasting and embodied manipulation.arXiv e-prints, pages arXiv–2511, 2025","venue":null,"work_id":"82e09845-ab11-487b-bab3-e01604261c27","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.471792Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:e2cca242beb9b40376afdf4865f44a966282d490d3f5237d4c4950e968a10dd1","observation_id":"afdde464-4467-49bb-b317-90bcf560cfe9","resolution":{"observed_at":"2026-08-06T06:08:28.047755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:27.687782Z","title":"Generalizing gaze estimation with outlier-guided collaborative adaptation","venue":null,"work_id":"4ecbd797-8277-42b6-8eec-b8f1c2de3452","year":2021},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.474102Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:5e911e4563551d5fc33896fcadeb4cf8bc844a93037c8bf9474ed7b3bcc6f591","observation_id":"4bedeffd-b3c4-43de-9ee9-e50f0d05fa27","resolution":{"observed_at":"2026-08-06T06:08:27.856661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.476931Z","title":"Playmate2: Training-free multi-character audio-driven animation via diffusion transformer with reward feedback.arXiv preprint arXiv:2510.12089, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.476931Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:df55b20fbd2104d8b6f7042719d8d3dce10c92444b50de0e26de018ea7d8cc5c","observation_id":"f03c0bd7-9337-4c68-b1c6-c5545a59d7d1","resolution":{"observed_at":"2026-08-06T06:07:34.476931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:27.362870Z","title":null,"venue":null,"work_id":"52514ac6-6c4c-4d6c-a5d1-a663cea66c54","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.479780Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:ea2123b474d5801a4e2e404795713d2fcfc9744b239a006d0d809a882e38e60a","observation_id":"51f7b8c5-957a-478b-96f7-fb567fbbdee8","resolution":{"observed_at":"2026-08-06T06:08:27.536899Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.482069Z","title":"Multimediate: Multi-modal group behaviour analysis for artificial mediation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.482069Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:505ecb73f5f9353dfe895bef37bd56f62fefe71d09c0e4a43a9d05c7ab57a001","observation_id":"ab0bca83-0938-4e3f-9061-be7e67ce6c82","resolution":{"observed_at":"2026-08-06T06:07:34.482069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24389","last_updated":"2025-08-28T04:31:31Z","snapshot_observed_at":"2026-08-07T12:20:58.594538Z","submitted_at":"2025-05-30T09:19:33Z","title":"Leadership Assessment in Pediatric Intensive Care Unit Team Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24389","snapshot_observed_at":"2026-08-06T06:07:34.484477Z","title":"Leadership assessment in pediatric intensive care unit team training.arXiv preprint arXiv:2505.24389, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.484477Z"},"links":{"cited_paper":"/paper/2505.24389","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:a6357d4c56e2158140ede6b6b960077d74fb2aa4c550cbef27a51380df78cfb8","observation_id":"28eecf18-749d-4350-8f12-88306a01cf77","resolution":{"observed_at":"2026-08-06T06:07:34.484477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:27.087064Z","title":"Multi-speaker attention alignment for multimodal social interaction","venue":null,"work_id":"2ed0c98b-3f0e-4eab-9416-cd3fab475a2b","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.487236Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:98806a4be45a3c8a5d19f6721bc9b047d1af931cdb21c68bc724855e5123415b","observation_id":"56da9984-efd2-429a-85ef-5c8e6d8a661b","resolution":{"observed_at":"2026-08-06T06:08:27.246735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10079","last_updated":"2026-05-11T07:01:38Z","snapshot_observed_at":"2026-07-06T23:22:03.830881Z","submitted_at":"2026-05-11T07:01:38Z","title":"SocialDirector: Training-Free Social Interaction Control for Multi-Person Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10079","snapshot_observed_at":"2026-08-06T06:07:34.489797Z","title":"Socialdirector: Training- free social interaction control for multi-person video generation.arXiv preprint arXiv:2605.10079, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.489797Z"},"links":{"cited_paper":"/paper/2605.10079","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:e450085edf8eaa626fd75d4e8aa7c3406b280e65bbdf1c0cee50d868aa34812d","observation_id":"09e4b57b-fb1b-49a5-b7ad-f1f584301a5b","resolution":{"observed_at":"2026-08-06T06:07:34.489797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:26.799668Z","title":"Svbench: Evaluation of video generation models on social reasoning","venue":null,"work_id":"03c17be2-1733-41c7-b013-ae08272bd77a","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.492399Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:c18a1fac2ee103d05cd1a976112d46bce8596b1db27af8e3ce05973548112ae5","observation_id":"54b80bc5-7685-441c-a194-1da91a10a243","resolution":{"observed_at":"2026-08-06T06:08:26.958346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.494676Z","title":"Dyadit: A multi-modal diffusion transformer for socially favorable dyadic gesture generation.arXiv preprint arXiv:2602.23165, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.494676Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:4095d2763147c45b88a4272af3dc2a385c7169027349f7ba7e4a4068cd8ecbe7","observation_id":"2c4cc2e6-04b1-4af2-b5c3-4841dc08fe6f","resolution":{"observed_at":"2026-08-06T06:07:34.494676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:26.555938Z","title":"Actavatar: Temporally-aware precise action control for talking avatars","venue":null,"work_id":"60eca9e5-e936-427e-9e5a-8d4634aba6c3","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.497175Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:b433cdcf25bfbf8187d5c0b4b6f0d0b8b37bb42b1dc8b7bcf3e1eb248ba47055","observation_id":"ed5d2ac6-3f3a-460a-9c32-b8c7a3faebaf","resolution":{"observed_at":"2026-08-06T06:08:26.681830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:26.278627Z","title":"Unigaze: Towards universal gaze estimation via large-scale pre-training","venue":null,"work_id":"9e3e0845-822b-4efe-8e4a-16493e522f47","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.499592Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:50faedc4b7d014ec10e316cbda69d64e44747c6dbad76c626b2c6cc1d2b7e1e8","observation_id":"a2119661-dafa-4216-b499-755943d9c688","resolution":{"observed_at":"2026-08-06T06:08:26.449440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:26.003199Z","title":"Qwen3.6-35B-A3B: Agentic coding power, now open to all, April 2026","venue":null,"work_id":"7f8119d0-24cf-4eae-872c-ad7ba7f7daec","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.501958Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bed3a0f2843af0f9d7cf5e571c051fa1f60d6031ea46fd331c58d585d1a3cf77","observation_id":"95c00974-5d9a-461a-96a6-e649b0876cba","resolution":{"observed_at":"2026-08-06T06:08:26.121057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.504273Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.504273Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:25efc84c9bdf7852876ee0d099c08335df74c05eaaae73c6f2f74af02f35919c","observation_id":"06a1696e-db0a-46e9-9907-20b71c9b8925","resolution":{"observed_at":"2026-08-06T06:07:34.504273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:25.710507Z","title":"Interact2ar: Full-body human-human interaction generation via autoregressive diffusion models","venue":null,"work_id":"77705563-7349-45ad-80a9-10d716026156","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.506755Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:c39b0e6bc86f72dfbdf936a37a3473184718a256e04196386f179e033bcdaae0","observation_id":"ad039aea-ffa3-4ab5-b489-379fe19b425c","resolution":{"observed_at":"2026-08-06T06:08:25.845367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.509351Z","title":"Solaris: Building a multiplayer video world model in minecraft.arXiv preprint arXiv:2602.22208, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.509351Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:5399df641a46ca79074c5f2f3cf86202e880bbca49d4222849b63ab780569f0f","observation_id":"5007943b-813a-4db0-8dd6-80a6073b4745","resolution":{"observed_at":"2026-08-06T06:07:34.509351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09507","last_updated":"2026-06-08T13:59:50Z","snapshot_observed_at":"2026-08-06T20:58:33.425839Z","submitted_at":"2026-06-08T13:59:50Z","title":"Prisma-World: Camera-Controllable Multi-Agent Video World Model","version":1},"cited_work":{"arxiv_id":"2606.09507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.09507","snapshot_observed_at":"2026-08-06T06:08:15.475977Z","title":"Prisma-World: Camera-Controllable Multi-Agent Video World Model","venue":"cs.CV","work_id":"fce57766-586c-4ba8-8638-556872ba5fba","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.511899Z"},"links":{"cited_paper":"/paper/2606.09507","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:ea6d9cc4a840fc81a62b4e21903ac567a99968d8acc9a796b16ac6179ac33792","observation_id":"125b0109-3651-48f3-9988-e644215be762","resolution":{"observed_at":"2026-08-06T06:08:15.480286Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-03T16:11:09.055651Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.14614","snapshot_observed_at":"2026-08-06T06:07:34.514739Z","title":"Worldplay: Towards long-term geometric consistency for real-time interactive world modeling.arXiv preprint arXiv:2512.14614, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.514739Z"},"links":{"cited_paper":"/paper/2512.14614","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:09402c9e7f600a47dc360308c07a3465d0f0bf85902baf17832c96269f0c0aca","observation_id":"f3423114-24b6-48f7-a867-222740934380","resolution":{"observed_at":"2026-08-06T06:07:34.514739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:25.429938Z","title":"Alayaworld: Long-horizon and playable video world generation,","venue":null,"work_id":"16fff6d4-5bac-471a-b134-7872df289adf","year":null},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.517331Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:1eea2574696ef7dba9cb08085428ad8b17695c4b6e7fc61b2a95a33f8c50af76","observation_id":"bffb5131-ad05-429a-9561-02849b84fa23","resolution":{"observed_at":"2026-08-06T06:08:25.560758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20540","last_updated":"2026-01-28T12:37:01Z","snapshot_observed_at":"2026-08-03T01:29:14.204066Z","submitted_at":"2026-01-28T12:37:01Z","title":"Advancing Open-source World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.20540","snapshot_observed_at":"2026-08-06T06:07:34.522917Z","title":"Advancing open-source world models.arXiv preprint arXiv:2601.20540, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.522917Z"},"links":{"cited_paper":"/paper/2601.20540","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:5ec7a6c5359b48941b3cd12f54716dacdbe4fe373f30399dc1d64126f582dca7","observation_id":"f6e156b0-8489-4a55-bb46-0caab6daa0e0","resolution":{"observed_at":"2026-08-06T06:07:34.522917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:25.110402Z","title":"Unsplash: Beautiful, free images and photos","venue":null,"work_id":"8059e63b-24da-4a71-b209-bae2c5b26c1c","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.525582Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:c95609d4e0ee12daa301ce6ee16c31a8104b53338b1a426a5f86aa7837e35cc3","observation_id":"1659a042-dd0a-469c-b2fe-cbf0bf785ddf","resolution":{"observed_at":"2026-08-06T06:08:25.226534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:24.806612Z","title":"Diffusion models are real-time game engines","venue":null,"work_id":"35324fcc-dd8a-4f22-b705-3c0a18f5bf40","year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.528046Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:73242b4338faca97e8da94ec0c24a96beeddc0f264587d8c89e6b2dd9ea8c414","observation_id":"90f2aff6-0307-4365-ac1b-eea74489bfd1","resolution":{"observed_at":"2026-08-06T06:08:24.992842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-06T06:07:34.530682Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.530682Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:b9f7165aad7ad9b385d3c946cec47163f9ddac92632e5900dc8a11c4fdd8f694","observation_id":"ebe59fa0-9908-4285-9692-16d84fa6c058","resolution":{"observed_at":"2026-08-06T06:07:34.530682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:24.398254Z","title":"Spatialvid: A large-scale video dataset with spatial annotations","venue":null,"work_id":"ced3ae01-7e61-4321-b982-a71db183618e","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.533404Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:7f53a11afd8b74c22b31b9eecd664b1d5c3812603f64d357de7b8d34d4b2eaf5","observation_id":"4902d716-9eac-4ebc-847a-7707271eda9c","resolution":{"observed_at":"2026-08-06T06:08:24.618595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12956","last_updated":"2025-07-17T09:50:43Z","snapshot_observed_at":"2026-08-06T21:23:59.012209Z","submitted_at":"2025-07-17T09:50:43Z","title":"FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12956","snapshot_observed_at":"2026-08-06T06:07:34.535804Z","title":"Fantasyportrait: Enhancing multi-character portrait animation with expression-augmented diffusion transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.535804Z"},"links":{"cited_paper":"/paper/2507.12956","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:3bee2b1d9362439e3fc99191e0030793eaab6750d2dc648e52431b41f05e4902","observation_id":"979f5c4d-4e40-4956-80a5-d8195902148a","resolution":{"observed_at":"2026-08-06T06:07:34.535804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15182","last_updated":"2026-05-14T17:58:26Z","snapshot_observed_at":"2026-08-03T09:29:25.949113Z","submitted_at":"2026-05-14T17:58:26Z","title":"Warp-as-History: Generalizable Camera-Controlled Video Generation from One Training Video","version":1},"cited_work":{"arxiv_id":"2605.15182","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15182","snapshot_observed_at":"2026-08-06T06:08:15.407122Z","title":"Warp-as-History: Generalizable Camera-Controlled Video Generation from One Training Video","venue":"cs.CV","work_id":"975faf80-d4f0-4ed0-a7b3-4a62f5020b17","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.538368Z"},"links":{"cited_paper":"/paper/2605.15182","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:5b3612cf1b68757d74576ad36dd0c5d40bb3bdf365ac74d4977dc04a8695f5f6","observation_id":"fbda0884-5445-49d9-b99b-b2ed0ab267f1","resolution":{"observed_at":"2026-08-06T06:08:15.410532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13347","last_updated":"2026-03-07T07:01:59Z","snapshot_observed_at":"2026-08-02T12:12:15.465550Z","submitted_at":"2025-07-17T17:59:53Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13347","snapshot_observed_at":"2026-08-06T06:07:34.541085Z","title":"π3: Permutation-equivariant visual geometry learning.arXiv preprint arXiv:2507.13347, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.541085Z"},"links":{"cited_paper":"/paper/2507.13347","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:ac8aab54966b9197a053142cfffdf2027ed61d154ab546afc6cd5452de7109c9","observation_id":"649f3d57-9a58-4f5c-8299-b46944a53720","resolution":{"observed_at":"2026-08-06T06:07:34.541085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15256","last_updated":"2026-05-14T17:52:03Z","snapshot_observed_at":"2026-08-06T12:51:31.154504Z","submitted_at":"2026-05-14T17:52:03Z","title":"ReactiveGWM: Steering NPC in Reactive Game World Models","version":1},"cited_work":{"arxiv_id":"2605.15256","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15256","snapshot_observed_at":"2026-08-06T06:08:15.386653Z","title":"ReactiveGWM: Steering NPC in Reactive Game World Models","venue":"cs.CV","work_id":"f255a4ec-c263-45ad-b8ff-beeff8e5c282","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.543800Z"},"links":{"cited_paper":"/paper/2605.15256","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:bd04ee6b40f19a55adeeb9d42b5d7dffbf400e5682ab198faaaf51ea759c0dc0","observation_id":"bb9bcdba-8d52-40bb-90dc-9bd16a9ab5fd","resolution":{"observed_at":"2026-08-06T06:08:15.390530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.546337Z","title":"Interacthuman: Multi-concept human animation with layout-aligned audio conditions.arXiv preprint arXiv:2506.09984, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.546337Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:3e38274ff9091838e40756c768f7cd81ae4cde273df28373afc8d6ffea2aa66e","observation_id":"f648ecf4-8ddd-4b1e-9a87-ef74b7035c6f","resolution":{"observed_at":"2026-08-06T06:07:34.546337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08995","snapshot_observed_at":"2026-08-06T06:07:34.548712Z","title":"Matrix-game 3.0: Real-time and streaming interactive world model with long-horizon memory.arXiv preprint arXiv:2604.08995, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.548712Z"},"links":{"cited_paper":"/paper/2604.08995","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:b72cabc5656c6c320f6805879d31407cedcc0aadd628d265ac8010d7d7a74ee3","observation_id":"cb1392e2-a5ef-41b8-b0fc-61e237d22556","resolution":{"observed_at":"2026-08-06T06:07:34.548712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17730","last_updated":"2026-06-16T09:47:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-16T09:47:32Z","title":"ActWorld: From Explorable to Interactive World Model via Action-Aware Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.17730","snapshot_observed_at":"2026-08-06T06:07:34.551706Z","title":"Actworld: From explorable to interactive world model via action-aware memory.arXiv preprint arXiv:2606.17730, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.551706Z"},"links":{"cited_paper":"/paper/2606.17730","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:8daf0a481e82e48a7706cbe64a92dfc0657e0d5a3780540d5c4ee059bb433ad8","observation_id":"0c510ae0-fff4-4e5d-b069-901d1dae7ea7","resolution":{"observed_at":"2026-08-06T06:07:34.551706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:23.867225Z","title":"Inter-x: Towards versatile human-human interaction analysis","venue":null,"work_id":"b4e7ebb3-5c18-4066-bb52-54ffa23983e4","year":2024},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.554503Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:b5b44d3e31f93e5338861af8c0e88277cb104a760775a86da40607902a5569e3","observation_id":"1904aa81-a8e3-438c-9b92-c395c6fbcb09","resolution":{"observed_at":"2026-08-06T06:08:24.088232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21686","last_updated":"2026-04-23T13:50:47Z","snapshot_observed_at":"2026-07-06T23:08:14.631453Z","submitted_at":"2026-04-23T13:50:47Z","title":"WorldMark: A Unified Benchmark Suite for Interactive Video World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.21686","snapshot_observed_at":"2026-08-06T06:07:34.556983Z","title":"Worldmark: A unified benchmark suite for interactive video world models.arXiv preprint arXiv:2604.21686, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.556983Z"},"links":{"cited_paper":"/paper/2604.21686","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:be5e45eff6b40ebd974a7b5001d60b374975f1f3549d5c8da7c3c8cd304219d9","observation_id":"bca0e2d3-1191-41c7-95f9-d232d90974fd","resolution":{"observed_at":"2026-08-06T06:07:34.556983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.20083","last_updated":"2026-07-01T14:45:31Z","snapshot_observed_at":"2026-08-03T13:07:32.043979Z","submitted_at":"2026-06-18T11:01:34Z","title":"Holo-World: Unified Camera, Object and Weather Control for Video World Model","version":3},"cited_work":{"arxiv_id":"2606.20083","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.20083","snapshot_observed_at":"2026-08-06T06:08:14.569797Z","title":"Holo-World: Unified Camera, Object and Weather Control for Video World Model","venue":"cs.CV","work_id":"df8d16c5-1ed1-4694-a4cf-45d3c87bc8a2","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.559497Z"},"links":{"cited_paper":"/paper/2606.20083","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:67949590e6f328041f4424b08cd8efcba3d7dbf5a1072a4078028f594bef3ef8","observation_id":"f909dfae-a9d1-4dfb-b04d-bd0c75d24d02","resolution":{"observed_at":"2026-08-06T06:08:14.574031Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25874","last_updated":"2026-05-25T14:01:31Z","snapshot_observed_at":"2026-07-06T23:35:46.157653Z","submitted_at":"2026-05-25T14:01:31Z","title":"WBench: A Comprehensive Multi-turn Benchmark for Interactive Video World Model Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25874","snapshot_observed_at":"2026-08-06T06:07:34.562197Z","title":"Wbench: A comprehensive multi-turn benchmark for interactive video world model evaluation.arXiv preprint arXiv:2605.25874, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.562197Z"},"links":{"cited_paper":"/paper/2605.25874","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:9d9e6d56324bd89fdbe70f80cabb703023198f2337ffbfbc46a3ca17f744413c","observation_id":"6c0a5bf3-0efb-467f-8391-4afb5f8fcd94","resolution":{"observed_at":"2026-08-06T06:07:34.562197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.11482","last_updated":"2026-06-09T22:15:51Z","snapshot_observed_at":"2026-07-06T23:50:35.052764Z","submitted_at":"2026-06-09T22:15:51Z","title":"Building Social World Models with Large Language Models","version":1},"cited_work":{"arxiv_id":"2606.11482","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.11482","snapshot_observed_at":"2026-08-06T06:08:14.541435Z","title":"Building Social World Models with Large Language Models","venue":"cs.SI","work_id":"c4bf331c-993d-447a-8550-801812478372","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.564854Z"},"links":{"cited_paper":"/paper/2606.11482","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:ad0251338160d3d37708d93685b42b42aded1c72200d351c1cdbb5563022230f","observation_id":"364864f5-b195-44d7-9af8-e434629a14da","resolution":{"observed_at":"2026-08-06T06:08:14.547597Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:08:23.639920Z","title":"Socialgen: Modeling multi-human social interaction with language models","venue":null,"work_id":"0acb0b75-1bcf-45d1-bf81-545671c27f7b","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.567371Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:8b438de27acd76efad1324ebbbf1e8a63d1bbe572f8bf7a4dc99f27ecfe54c7d","observation_id":"f1d809de-5872-47f5-a9f3-f94bbfc2f85a","resolution":{"observed_at":"2026-08-06T06:08:23.733481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.569605Z","title":"Gamefactory: Creating new games with generative interactive videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.569605Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:285d07a785f00f7ddc7fcebe528b47cd0bb4606769d08158058715707e5ed570","observation_id":"59dbd000-e60f-477e-ae05-4143d99a2d48","resolution":{"observed_at":"2026-08-06T06:07:34.569605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.572287Z","title":"Helios: Real real-time long video generation model.arXiv preprint arXiv:2603.04379, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.572287Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:2c514e9ff34986db9dbdbc52a9357e41318e6985bf9b8c020e24de4c5566bad1","observation_id":"b31979b7-63a0-4169-a4a6-b10170ba7cc1","resolution":{"observed_at":"2026-08-06T06:07:34.572287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.575022Z","title":"Social-iq: A question answering benchmark for artificial social intelligence","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.575022Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:48809a3c195cbdb3a99ad5d77aca8eff523ff5ae25628e81764c80146fd93e5a","observation_id":"d0d1824d-488a-4d2c-8c86-1b981cc19c54","resolution":{"observed_at":"2026-08-06T06:07:34.575022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10157","last_updated":"2025-07-15T11:14:36Z","snapshot_observed_at":"2026-08-07T16:05:55.074747Z","submitted_at":"2025-04-14T12:12:52Z","title":"SocioVerse: A World Model for Social Simulation Powered by LLM Agents and A Pool of 10 Million Real-World Users","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10157","snapshot_observed_at":"2026-08-06T06:07:34.577651Z","title":"Socioverse: A world model for social simulation powered by llm agents and a pool of 10 million real-world users.arXiv preprint arXiv:2504.10157, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.577651Z"},"links":{"cited_paper":"/paper/2504.10157","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:4041b71686ef0b8388c265fa3d0ded81b280104b4722c8529550e5ef6e0c3dde","observation_id":"6e750754-9ef8-40a4-9327-bb02619b3ce6","resolution":{"observed_at":"2026-08-06T06:07:34.577651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.580143Z","title":"Anytalker: Scaling multi-person talking video generation with interactivity refinement.arXiv preprint arXiv:2511.23475, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.580143Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:5f998c0dd39f0113c6fa53f55d84374a9958a3023a20baf3241c7e1e2dd5800f","observation_id":"926a1039-1805-4198-af3d-b0d7c1881f13","resolution":{"observed_at":"2026-08-06T06:07:34.580143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.582548Z","title":"Stereo magnification: learning view synthesis using multiplane images.ACM Transactions on Graphics (TOG), 37(4):1–12, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.582548Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:baf97e210583a4aa9808b9a1a44b7db218e41b4453dd96ccd84ea219f5615d23","observation_id":"9a7c5d12-e861-4f3d-9b3b-c6c3f735965b","resolution":{"observed_at":"2026-08-06T06:07:34.582548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.584860Z","title":"Social world models.arXiv preprint arXiv:2509.00559, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.584860Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:5e239e54d7f392fe9b5af6454dfef8f49d2f3faad8b018778a7f06f2b38793b6","observation_id":"832c8a36-4073-43dc-9dfa-3ddc0ce28c65","resolution":{"observed_at":"2026-08-06T06:07:34.584860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.587199Z","title":"Omniworld: A multi-domain and multi-modal dataset for 4d world modeling.arXiv preprint arXiv:2509.12201, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.587199Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:1dd69e27608fb91b774d26c05ba223d0a1c2f9a33315034937c1f13fade6f427","observation_id":"3b8034f1-3efe-4167-8720-11ecde6203dc","resolution":{"observed_at":"2026-08-06T06:07:34.587199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.589448Z","title":"Evaltalker: Learning to evaluate real-portrait-driven multi-subject talking humans.arXiv preprint arXiv:2512.01340, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.589448Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:1d5c1d5912d9127830e70f02ec62cd8b2bed6028396719928617349cd3cb9c95","observation_id":"62e2cdc1-bed8-4db9-a7d9-a22a812bbd39","resolution":{"observed_at":"2026-08-06T06:07:34.589448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15178","last_updated":"2026-05-14T17:58:03Z","snapshot_observed_at":"2026-08-06T16:58:37.665408Z","submitted_at":"2026-05-14T17:58:03Z","title":"SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15178","snapshot_observed_at":"2026-08-06T06:07:34.592251Z","title":"Sana-wm: Efficient minute-scale world modeling with hybrid linear diffusion transformer","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.592251Z"},"links":{"cited_paper":"/paper/2605.15178","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:391232760e1e85b08ee2e1a842fe3b5ac60a9365af15f2a58bc41dc69565a0d2","observation_id":"0b2272af-3298-4037-b147-b56508cce071","resolution":{"observed_at":"2026-08-06T06:07:34.592251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:07:34.594968Z","title":"Astra: General interactive world model with autoregressive denoising.arXiv preprint arXiv:2512.08931, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.594968Z"},"links":{"citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:e2db3e5a4cbe2cdda0b084a98c7d2b6664e7aaef97305494864baf84d893cee9","observation_id":"07045935-0a78-4e73-b9bd-27a3912f3b9a","resolution":{"observed_at":"2026-08-06T06:07:34.594968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06291","last_updated":"2026-07-07T13:59:57Z","snapshot_observed_at":"2026-08-07T13:27:54.852993Z","submitted_at":"2026-07-07T13:59:57Z","title":"AlayaWorld: Long-Horizon and Playable Video World Generation","version":1},"cited_work":{"arxiv_id":"2607.06291","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.06291","snapshot_observed_at":"2026-08-06T06:08:15.445957Z","title":"AlayaWorld: Long-Horizon and Playable Video World Generation","venue":"cs.CV","work_id":"e5533d59-45ae-4293-918e-fa51589754b1","year":2026},"citing_paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T06:07:34.519966Z"},"links":{"cited_paper":"/paper/2607.06291","citing_paper":"/paper/2608.05070"},"observation_digest":"sha256:6ec1e0af81b0fce967ad848b8231efb5141acb8c25d7aa94a36e4ff8ef83bd25","observation_id":"d58b23ff-c187-47ce-b1ba-d80288623957","resolution":{"observed_at":"2026-08-06T06:08:15.450348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.05070","last_updated":"2026-08-05T17:14:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T18:19:32.020646Z","submitted_at":"2026-08-05T17:14:19Z","title":"HelloWorld: Enabling Socially Interactive Characters in Video World Models"},"reference_resolution":{"displayed":83,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":8,"verified_fuzzy":29},"total_outbound_references":83},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 0 inbound Pith citation observations for arXiv:2608.05070."}