{"as_of":"2026-08-07T02:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d2c8af2acb4588155729dfb947f7fd1028a160155f732eab60992606ef40ff4","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T21:00:58.473043Z","state":"measured"},{"denominator":110,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":110,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":74,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:49.071339Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2602.07064","last_updated":"2026-04-07T13:49:35Z","snapshot_observed_at":"2026-08-03T13:22:02.057620Z","submitted_at":"2026-02-05T14:04:51Z","title":"OmniFysics: Towards Physical Intelligence Evolution via Omni-Modal Signal Processing and Network Optimization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T07:09:46.254851Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2602.07064"},"observation_digest":"sha256:483b5589dd2fbbcd2772d341a01a31849276400fe55b50e117475d6b740169ad","observation_id":"64724f55-ffd3-4fdc-86ad-bfd23c8b38d9","resolution":{"observed_at":"2026-05-16T07:10:43.160325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-07-13T23:54:26.281624Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16271","last_updated":"2026-06-30T03:31:28Z","snapshot_observed_at":"2026-07-13T23:53:56.592969Z","submitted_at":"2026-03-17T09:04:10Z","title":"VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T23:54:26.281624Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2603.16271"},"observation_digest":"sha256:6096428c7f92e7117f742883c199da704dc45edb5fd7f815198ef1971eb6c062","observation_id":"04a43652-ad5a-430e-b4f1-3a73fff4b250","resolution":{"observed_at":"2026-07-13T23:54:26.281624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-07-13T22:08:47.493022Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.19226","last_updated":"2026-07-02T17:59:52Z","snapshot_observed_at":"2026-08-06T17:22:57.751005Z","submitted_at":"2026-03-19T17:59:45Z","title":"Under One Sun: Multi-Object Generative Perception of Materials and Illumination","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T22:08:47.493022Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2603.19226"},"observation_digest":"sha256:9181d60416a842cd844df4ad2a20cf04977b73a00047b8a8cd9ad3f7476e3093","observation_id":"9d6b9932-19e6-40d8-b8fb-b1386699e868","resolution":{"observed_at":"2026-07-13T22:08:47.493022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-07-13T18:01:19.034578Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25743","last_updated":"2026-06-29T08:23:47Z","snapshot_observed_at":"2026-08-04T12:34:23.023983Z","submitted_at":"2026-03-26T17:59:57Z","title":"RefAlign: Representation Alignment for Reference-to-Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T18:01:19.034578Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2603.25743"},"observation_digest":"sha256:792b768997c0608fc7c8ee173a973e9b8e7b59583d317d9678c12a5188a1a039","observation_id":"2e0b3702-7c09-48e2-97cd-c4e0eb36a9f9","resolution":{"observed_at":"2026-07-13T18:01:19.034578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.07958","last_updated":"2026-04-23T12:58:42Z","snapshot_observed_at":"2026-07-06T22:57:09.435331Z","submitted_at":"2026-04-09T08:22:09Z","title":"ImVideoEdit: Image-learning Video Editing via 2D Spatial Difference Attention Blocks","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T17:49:33.822264Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.07958"},"observation_digest":"sha256:a856c4778d04d9a476e55b8ea1f23ad3453d980fa5fa403a5cf387c40599403e","observation_id":"70903710-cc96-4ae5-b8e9-e7215ce0ca67","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.08641","last_updated":"2026-04-09T17:30:10Z","snapshot_observed_at":"2026-08-02T18:54:30.375399Z","submitted_at":"2026-04-09T17:30:10Z","title":"On Semiotic-Grounded Interpretive Evaluation of Generative Art","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T18:35:53.179645Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.08641"},"observation_digest":"sha256:43149f049d675e792d34b3a114768921cd9a2afd0524fe479cd01eaf65be5ca1","observation_id":"c5f23e56-ace8-4502-9538-880b220f349a","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.08646","last_updated":"2026-04-09T17:59:02Z","snapshot_observed_at":"2026-07-06T22:57:40.773778Z","submitted_at":"2026-04-09T17:59:02Z","title":"InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T17:39:59.791758Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.08646"},"observation_digest":"sha256:397e263053ee5600a09ef09d707d17cc019d549b8d22ee4316224c108f4d83d9","observation_id":"f0ab2988-152b-4adc-9d4c-5ca015e76d70","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T18:24:14.349469Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.08995"},"observation_digest":"sha256:de5bbb0882876fc2e67557b2a45f670a8fea8725e90296ae00922e4ac319d398","observation_id":"ce9989f6-62e0-4733-a360-5bc713ba952f","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.11789","last_updated":"2026-04-20T14:38:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T17:55:02Z","title":"LMMs Meet Object-Centric Vision: Understanding, Segmentation, Editing and Generation","version":2},"reference_index":157,"source":"pdf_text","source_observed_at":"2026-05-10T15:35:37.095627Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.11789"},"observation_digest":"sha256:201ba8a110a9d810808133de49b17496e8fae9f43541cbf2cc601bfd75e1575d","observation_id":"ca5de142-2a73-49cf-bb9e-18ae6fceeae8","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.11804","last_updated":"2026-04-17T08:08:09Z","snapshot_observed_at":"2026-08-06T16:53:42.723002Z","submitted_at":"2026-04-13T17:59:12Z","title":"OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T15:09:02.727887Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.11804"},"observation_digest":"sha256:b27b7cc616fe343fbab5a34847b0cdf9d11d5ee566d0c9b1102e399d0d7e1568","observation_id":"789d9386-e5fa-4bdc-9bb3-9bbcd33da32b","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.16592","last_updated":"2026-04-17T17:51:46Z","snapshot_observed_at":"2026-07-06T23:03:52.631613Z","submitted_at":"2026-04-17T17:51:46Z","title":"Human Cognition in Machines: A Unified Perspective of World Models","version":1},"reference_index":168,"source":"pdf_text","source_observed_at":"2026-05-10T08:12:15.663761Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.16592"},"observation_digest":"sha256:d4d2006793a2096947b711ecd223762d7e7ad2d05c757ded3582ae8c560ce1d4","observation_id":"8bf03dec-55e8-4999-8978-1287a8db80fc","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.19193","last_updated":"2026-04-21T08:04:02Z","snapshot_observed_at":"2026-08-02T22:05:18.077263Z","submitted_at":"2026-04-21T08:04:02Z","title":"How Far Are Video Models from True Multimodal Reasoning?","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T02:44:52.920816Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.19193"},"observation_digest":"sha256:fe9e5b04abfce6bd4bbcc97dbc4403b940111941bd1620fcbc19ba2c07eb3df7","observation_id":"d7443b29-6b35-43ed-98c2-d638fe66a287","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.25427","last_updated":"2026-04-28T09:34:51Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T09:34:51Z","title":"A Systematic Post-Train Framework for Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T16:58:33.014401Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.25427"},"observation_digest":"sha256:f131b5070bfa76469314832a812b39b0347f923836f864126e6bdc2b4694292a","observation_id":"b5c8659c-fda4-4361-aaad-6383d305dacc","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2604.27711","last_updated":"2026-04-30T10:57:29Z","snapshot_observed_at":"2026-07-06T23:13:07.378140Z","submitted_at":"2026-04-30T10:57:29Z","title":"ExoActor: Exocentric Video Generation as Generalizable Interactive Humanoid Control","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T06:24:47.014162Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2604.27711"},"observation_digest":"sha256:1cb690ea3a0c7dbeb422a85b0ab2f9df18b1b95d0f5e924667b70604c3ca635f","observation_id":"b2ba2a9a-c04c-4919-9f8a-e10d555b549c","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.01720","last_updated":"2026-05-06T16:29:09Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:26:26Z","title":"SignVerse-2M: A Two-Million-Clip Pose-Native Universe of 55+ Sign Languages","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T15:43:36.954114Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.01720"},"observation_digest":"sha256:942fcd776883e3ba8471d3f44ab3d2466ff4e1b0d4207efe5cde0ef32d86f34c","observation_id":"d610d17d-8985-4287-b13a-21acafa59b7d","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.03652","last_updated":"2026-05-11T07:22:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T11:36:52Z","title":"AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T01:23:27.990472Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.03652"},"observation_digest":"sha256:8dc5014af2e92d3b89e64b85734f1aad1b6a7c619ad7c4cc3adc2c93d6abb784","observation_id":"101e058d-69d8-4791-9acf-f65b05b9f208","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.03652","last_updated":"2026-05-11T07:22:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T11:36:52Z","title":"AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T19:04:02.414172Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.03652"},"observation_digest":"sha256:4351321e55ec6282c9e86ada5a6340fe0f1e98080b23de1fff75eb2ef85ac15d","observation_id":"6d2390d9-ebcf-4b7c-9b1f-f96f80373999","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.03652","last_updated":"2026-05-11T07:22:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T11:36:52Z","title":"AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T03:39:47.335022Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.03652"},"observation_digest":"sha256:84258f23d2ed1cf2c9f6673388ecf61ef24b96f29ba7ecab5cbc362c3e143cb2","observation_id":"6549a769-5a8e-425b-ad74-d9e5c8434bd1","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.04515","last_updated":"2026-05-06T05:48:56Z","snapshot_observed_at":"2026-08-06T20:21:26.793848Z","submitted_at":"2026-05-06T05:48:56Z","title":"From Priors to Perception: Grounding Video-LLMs in Physical Reality","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T17:41:23.233366Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.04515"},"observation_digest":"sha256:d498bd602b093dc6551ccfd1c59885fb0c983e2eec29478d379049e13a6cd9f5","observation_id":"d1551fb0-25ba-4cb1-8d10-90f6fd9fcc81","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.07061","last_updated":"2026-05-29T22:08:19Z","snapshot_observed_at":"2026-08-03T12:53:30.755817Z","submitted_at":"2026-05-08T00:14:07Z","title":"Do Joint Audio-Video Generation Models Understand Physics?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T02:12:04.230076Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.07061"},"observation_digest":"sha256:ec84da709fd60d050d7df37b2823cc3e842a5df6bd85a088dce92e8b5815cbc3","observation_id":"2c80fe29-49dd-42fa-8b1e-d1c9170eea2d","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.07061","last_updated":"2026-05-29T22:08:19Z","snapshot_observed_at":"2026-08-03T12:53:30.755817Z","submitted_at":"2026-05-08T00:14:07Z","title":"Do Joint Audio-Video Generation Models Understand Physics?","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T23:39:22.070629Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.07061"},"observation_digest":"sha256:ac24f092a91b7ca356b1d72b34673ca1a2c751d50507f21cc135991582f83a28","observation_id":"b99f848b-3f92-44c0-b1c3-d1f9628e34e9","resolution":{"observed_at":"2026-06-30T23:45:08.219778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.11723","last_updated":"2026-05-28T12:50:43Z","snapshot_observed_at":"2026-08-01T23:43:09.636688Z","submitted_at":"2026-05-12T08:08:33Z","title":"CaC: Advancing Video Reward Models via Hierarchical Spatiotemporal Concentrating","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T06:00:31.582714Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.11723"},"observation_digest":"sha256:fb6e3a049af7575d062c7a069f6a5a899f56126b5e31e669caffb1de99ee242d","observation_id":"f3886654-bc2a-4a30-ab30-0d7a190c7cb2","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.11723","last_updated":"2026-05-28T12:50:43Z","snapshot_observed_at":"2026-08-01T23:43:09.636688Z","submitted_at":"2026-05-12T08:08:33Z","title":"CaC: Advancing Video Reward Models via Hierarchical Spatiotemporal Concentrating","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-30T22:38:43.102769Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.11723"},"observation_digest":"sha256:032d06e01cf4b0e44068ee7e291fe1b873c80b2986e040890b029a129ebf6b02","observation_id":"41d7d42b-be2c-47dc-a907-ec2ee64c9648","resolution":{"observed_at":"2026-07-01T13:55:45.200969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.12038","last_updated":"2026-05-12T12:21:11Z","snapshot_observed_at":"2026-08-03T04:49:14.402546Z","submitted_at":"2026-05-12T12:21:11Z","title":"OmniHumanoid: Streaming Cross-Embodiment Video Generation with Paired-Free Adaptation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T06:54:49.169238Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.12038"},"observation_digest":"sha256:d1529c0b059a8df89bca17d141df020f0ed5a1797bb999fa319036950a8c6fdd","observation_id":"2b88e94f-b4d7-4bde-b182-c7cd87624f39","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.14382","last_updated":"2026-06-29T03:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-14T05:06:57Z","title":"Delta Forcing: Trust Region Steering for Interactive Autoregressive Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T01:52:14.874049Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.14382"},"observation_digest":"sha256:7b1f91a13eb4c486fa839e9ca4db492fe550ba20b995d16eb3793f09951c6d84","observation_id":"b67e05a7-2cad-4970-b3df-3010a90f2783","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.14382","last_updated":"2026-06-29T03:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-14T05:06:57Z","title":"Delta Forcing: Trust Region Steering for Interactive Autoregressive Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T21:54:33.902256Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.14382"},"observation_digest":"sha256:a7acd6a335ffedcc4a914b60ef8a8b733a108434fcaf27c1c117a917da8df446","observation_id":"f10ab88e-494b-41a1-bef8-6c233ebbe5aa","resolution":{"observed_at":"2026-05-20T21:59:06.591674Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.14382","last_updated":"2026-06-29T03:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-14T05:06:57Z","title":"Delta Forcing: Trust Region Steering for Interactive Autoregressive Video Generation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T09:12:35.777810Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.14382"},"observation_digest":"sha256:fd549a1280526a3bd52b101a1b3fb2399671e59cd2eb0eced05f02a76b014bf6","observation_id":"aa137ada-a165-4b06-9f7f-e9a7814d10f0","resolution":{"observed_at":"2026-05-21T09:14:05.681958Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.14382","last_updated":"2026-06-29T03:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-14T05:06:57Z","title":"Delta Forcing: Trust Region Steering for Interactive Autoregressive Video Generation","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T21:44:21.427570Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.14382"},"observation_digest":"sha256:548fbcb0f1c3d1314fc97f4bc2f94cc849f4e9c00b8b521e6de6dec8d686b4d9","observation_id":"9e0ed9dd-eb08-4776-9dca-32a2450b06cf","resolution":{"observed_at":"2026-06-30T21:45:05.482142Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.14664","last_updated":"2026-05-26T03:55:48Z","snapshot_observed_at":"2026-08-02T00:36:02.181810Z","submitted_at":"2026-05-14T10:19:19Z","title":"MiVE: Multiscale Vision-language features for reference-guided video Editing","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-15T05:23:20.179387Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.14664"},"observation_digest":"sha256:cbb61571e7309c7bd13bfe4e90623e8f43ff3e717639f4f8effdbc79431e2395","observation_id":"9eaed66f-860f-402d-8dfd-12cff8d756c4","resolution":{"observed_at":"2026-05-15T21:00:58.771713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.15237","last_updated":"2026-05-14T01:28:16Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T01:28:16Z","title":"A3D: Agentic AI flow for autonomous Accelerator Design","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T16:23:07.321817Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.15237"},"observation_digest":"sha256:05ea664599e2909f6f3d45c22150bca85c9171736e0aee24ab3e5fef474dfd1f","observation_id":"b7af3177-6419-40e8-a274-6b882357f4f9","resolution":{"observed_at":"2026-05-19T16:23:08.509686Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.16003","last_updated":"2026-05-15T14:33:09Z","snapshot_observed_at":"2026-07-06T23:27:15.745896Z","submitted_at":"2026-05-15T14:33:09Z","title":"Echo-Forcing: A Scene Memory Framework for Interactive Long Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T20:02:45.505404Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.16003"},"observation_digest":"sha256:72b43ff85e32c1523695c0fa0cbffe0218304ac2a2733b92255fd1a3fba8bacd","observation_id":"b74cf4aa-15be-4906-a762-014b9c888b61","resolution":{"observed_at":"2026-05-20T20:03:43.379243Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.17019","last_updated":"2026-05-16T14:45:32Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T14:45:32Z","title":"StreamingEffect: Real-Time Human-Centric Video Effect Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T20:11:47.359922Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.17019"},"observation_digest":"sha256:0a77ad98cf8d8e8858dcca99eb1e9c61ecbe9964db8e182489b6a8f301631903","observation_id":"a3e0b65f-3741-4cfa-b8aa-3bc359099336","resolution":{"observed_at":"2026-05-19T20:12:44.833694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.17312","last_updated":"2026-05-17T08:03:53Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T08:03:53Z","title":"VISTA: Triplet-Supervised Video Style Transfer with Diffusion Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-20T14:14:41.662856Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.17312"},"observation_digest":"sha256:6aa21548b13891a44fdd3a380ea7a177988f2254b1fa636e85016811d869ac1b","observation_id":"90936041-d416-4713-8820-6300d723e4e6","resolution":{"observed_at":"2026-05-20T14:18:21.341819Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.17423","last_updated":"2026-05-17T12:38:21Z","snapshot_observed_at":"2026-08-01T16:00:11.560764Z","submitted_at":"2026-05-17T12:38:21Z","title":"Soap2Soap: Long Cinematic Video Remaking via Multi-Agent Collaboration","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T13:15:54.413960Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.17423"},"observation_digest":"sha256:88c3676c90d65ddf774b5e2bae8e463e7fff0517c1345b116213d5ef697e3de4","observation_id":"38a7eb05-fc6e-428b-acbc-40b824be2614","resolution":{"observed_at":"2026-05-20T13:18:18.326591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.17923","last_updated":"2026-05-18T06:30:31Z","snapshot_observed_at":"2026-08-03T06:19:48.849871Z","submitted_at":"2026-05-18T06:30:31Z","title":"AdaptiveLoad: Towards Efficient Video Diffusion Transformer Training","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-20T01:03:08.765350Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.17923"},"observation_digest":"sha256:0f9a182d6eac0d77bf1319fdb2149f52f65afd4b46ad5ed52a658e78e54d02b0","observation_id":"27f86da0-70bf-40cc-baaa-0f10354fbf56","resolution":{"observed_at":"2026-05-20T01:03:18.407272Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.22051","last_updated":"2026-05-21T06:38:22Z","snapshot_observed_at":"2026-07-06T23:32:25.286443Z","submitted_at":"2026-05-21T06:38:22Z","title":"EasyVFX: Frequency-Driven Decoupling for Resource-Efficient VFX Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T06:30:18.961069Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.22051"},"observation_digest":"sha256:cee4141196c2ef13dcd0f89ad9709b876847ebcc0ed0132b330592dafdde2220","observation_id":"1f01574b-b036-4498-856c-9eb6e482b434","resolution":{"observed_at":"2026-05-22T06:31:09.767846Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.22344","last_updated":"2026-05-21T11:30:29Z","snapshot_observed_at":"2026-07-06T23:32:39.761431Z","submitted_at":"2026-05-21T11:30:29Z","title":"Bernini: Latent Semantic Planning for Video Diffusion","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-22T06:39:47.124605Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.22344"},"observation_digest":"sha256:de34f0c4f8db477266a76613f5fd1aa59ac73d5da37ea8071b17ed7ff432cec4","observation_id":"7b5f7d40-46c4-4845-ab19-c95b7bda06d2","resolution":{"observed_at":"2026-05-22T06:41:10.412914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.25343","last_updated":"2026-05-25T01:57:43Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-25T01:57:43Z","title":"Toward Native Multimodal Modeling: A Roadmap","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T22:58:38.610609Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.25343"},"observation_digest":"sha256:1452bdbbfd208c0be98da27d19b6e2efed33b45f1a4b37ac68f0dc8c7fa6a9dd","observation_id":"588234ed-d0fc-425c-ae57-73db39f290bc","resolution":{"observed_at":"2026-06-29T23:04:01.878835Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.26244","last_updated":"2026-05-25T18:12:09Z","snapshot_observed_at":"2026-08-06T05:46:08.521756Z","submitted_at":"2026-05-25T18:12:09Z","title":"LongAV-Compass: Towards Unified Evaluation of Minute-Scale Audio-Visual Generation Across T2AV, I2AV, and V2AV","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T22:52:38.330851Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.26244"},"observation_digest":"sha256:0274dc1dc238ec03c850961e5ad85b7405d9323e7d573a05208c795014fba705","observation_id":"ceae481a-ac20-4eb0-9eb8-331b9415e472","resolution":{"observed_at":"2026-06-29T22:54:00.745998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-05T09:42:53.562841Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:3fc8f836f8b5d1a53bde23f900c3ba6a107242ac1fe7ddbd8417af384177280a","observation_id":"ee9f6de7-f860-4d0c-8c85-b069dd08ac54","resolution":{"observed_at":"2026-06-29T18:23:50.395028Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.27891","last_updated":"2026-05-27T03:16:09Z","snapshot_observed_at":"2026-08-06T16:42:38.969281Z","submitted_at":"2026-05-27T03:16:09Z","title":"SmartDirector: Keyframe-Conditioned Cinematic Video Generation with Narrative Pacing Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T13:47:41.094467Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.27891"},"observation_digest":"sha256:8d165fb7c32f0ffe23cfefc2f88eb50a472ee14211dcafe5fe95163fa56a0457","observation_id":"38a0d5df-af4e-4660-9f40-4b988a88a16d","resolution":{"observed_at":"2026-06-29T13:53:28.797194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.28203","last_updated":"2026-05-27T09:26:46Z","snapshot_observed_at":"2026-07-06T23:37:50.157617Z","submitted_at":"2026-05-27T09:26:46Z","title":"Refining Multidimensional Video Reward Models via Disentangled Influence Functions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T13:45:43.662583Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.28203"},"observation_digest":"sha256:d0741b2266fa50ca00a3a4b44682ce81beda4dbf481a4a955cf1924ac4940b6e","observation_id":"c0485399-117f-40bb-ad74-2277ecb07f06","resolution":{"observed_at":"2026-06-29T13:53:28.907216Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.30083","last_updated":"2026-05-28T15:30:04Z","snapshot_observed_at":"2026-07-06T23:39:24.682426Z","submitted_at":"2026-05-28T15:30:04Z","title":"Future Forcing: Future-aware Training-free KV Cache Policy for Autoregressive Video Generation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-29T08:30:00.438334Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.30083"},"observation_digest":"sha256:7f8434e130113affe48180d270e19e7d9c5b0a4f59355848646d87f02e7640a3","observation_id":"ead35053-ff3f-41ad-ba54-9c7b5a2239e5","resolution":{"observed_at":"2026-06-29T08:33:15.167914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.02274","last_updated":"2026-06-06T05:27:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-01T14:01:11Z","title":"Dexterity-BEV: Aligning 3D World and Actions for Generalizable Robot Policies Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T14:41:50.084254Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.02274"},"observation_digest":"sha256:dca7d2057b9b184f9d7ce8f07a8ce5f2bf97b0fbcfa4fbe91494a80965faeceb","observation_id":"7b8339ca-ca02-4a08-8939-515df378f305","resolution":{"observed_at":"2026-07-01T23:06:20.368827Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.02402","last_updated":"2026-06-01T15:48:38Z","snapshot_observed_at":"2026-08-03T23:23:36.546416Z","submitted_at":"2026-06-01T15:48:38Z","title":"Explainable Forensics of Manipulated Segments in Untrimmed Long Videos","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T14:49:11.015838Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.02402"},"observation_digest":"sha256:da4196bd68ea6fe1b7a6c7358b8897de2e77584e59a48a398253a4274c53faf9","observation_id":"094d3695-7dc7-4d1d-8bd5-aeccb158fb79","resolution":{"observed_at":"2026-07-01T22:56:21.013915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.02443","last_updated":"2026-06-01T16:14:01Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T16:14:01Z","title":"PaSBench-Video: A Streaming Video Benchmark for Proactive Safety Warning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-28T14:29:16.771243Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.02443"},"observation_digest":"sha256:7339f0903c09fc5ef635af4b190c408b5af7875e1920b59b4e4319042eec4352","observation_id":"c5f6fdbc-cb3f-469f-8553-e9e9620e8ab6","resolution":{"observed_at":"2026-06-28T14:32:17.846832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.04811","last_updated":"2026-06-04T10:52:20Z","snapshot_observed_at":"2026-08-02T17:55:30.069492Z","submitted_at":"2026-06-03T12:35:35Z","title":"Dream.exe: Can Video Generation Models Dream Executable Robot Manipulation?","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-28T06:33:03.192410Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.04811"},"observation_digest":"sha256:13a0f566e324cea1ca10f4a7495fd3d7eff3507dc4572d7c718d6da3a9fcde3b","observation_id":"d036f3b9-154b-4786-947a-4dabbc6487e9","resolution":{"observed_at":"2026-07-02T07:56:47.483368Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.11969","last_updated":"2026-06-10T11:49:54Z","snapshot_observed_at":"2026-07-06T23:50:58.297354Z","submitted_at":"2026-06-10T11:49:54Z","title":"SpecLoR: Spectral Lookahead Rectification for Motion-Coherent Text-to-Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T10:00:35.608696Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.11969"},"observation_digest":"sha256:780ff25be021039ce742553bda582199e3c4512c75f9620da967f16524a9edec","observation_id":"3cff5df0-7d96-46e7-8d78-afcaa9c60359","resolution":{"observed_at":"2026-07-03T10:27:56.804699Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.17257","last_updated":"2026-06-15T20:03:09Z","snapshot_observed_at":"2026-08-02T05:58:02.918004Z","submitted_at":"2026-06-15T20:03:09Z","title":"Pulling The REINS: Training-Free Safety Alignment of Video Diffusion Models via Representation Steering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T03:44:36.071488Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.17257"},"observation_digest":"sha256:26f62986e1cfcfdb4f4cf195a702d271b43bd771547dde7de83e5ad62fac8970","observation_id":"b4ecee77-634a-45ee-8504-7c0cac5d7f65","resolution":{"observed_at":"2026-07-03T17:48:45.910408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.20094","last_updated":"2026-06-18T11:13:50Z","snapshot_observed_at":"2026-08-02T06:09:06.599520Z","submitted_at":"2026-06-18T11:13:50Z","title":"MakeupMirror: Improving Facial Attribute Preservation in Diffusion Models for Makeup Transfer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T17:59:56.102450Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.20094"},"observation_digest":"sha256:97212a759995cfdbf4c1bd802b648fadc62059561c26b4aae1bed2c4bec668c7","observation_id":"5e8dbd2b-aa40-461b-b6ac-ed4d1b1fe031","resolution":{"observed_at":"2026-07-04T03:29:30.604905Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.20799","last_updated":"2026-07-15T15:45:17Z","snapshot_observed_at":"2026-08-02T10:48:03.144592Z","submitted_at":"2026-06-18T18:00:03Z","title":"GroundShot: Visually Consistent Multi-Shot Long Video Generation via Entity-Grounded Shot Scheduling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T18:15:51.862192Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.20799"},"observation_digest":"sha256:bc0ac8fa01734a29e92bd8c585983a8df26a042fe7e035915823eedbd129f26a","observation_id":"312e7616-378e-4c9f-8e34-2747dfec257a","resolution":{"observed_at":"2026-07-04T03:19:30.207258Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-02T10:48:05.083096Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20799","last_updated":"2026-07-15T15:45:17Z","snapshot_observed_at":"2026-08-02T10:48:03.144592Z","submitted_at":"2026-06-18T18:00:03Z","title":"GroundShot: Visually Consistent Multi-Shot Long Video Generation via Entity-Grounded Shot Scheduling","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T10:48:05.083096Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.20799"},"observation_digest":"sha256:158676830711264dde8c1739fe10350b43fa38604721a04866126dd5cb90cee5","observation_id":"71757a9f-038b-4224-8f81-08b39980631d","resolution":{"observed_at":"2026-08-02T10:48:05.083096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.24225","last_updated":"2026-06-23T07:11:45Z","snapshot_observed_at":"2026-07-06T23:58:49.574536Z","submitted_at":"2026-06-23T07:11:45Z","title":"Geometry-Instructed Video Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T00:43:03.861412Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.24225"},"observation_digest":"sha256:96cd84dcf8aad95d7e6224e842353e3b0f204e02e5b7f610ec05d2b1ccd598b0","observation_id":"00b49291-8007-4c3f-a20b-a3017e18be92","resolution":{"observed_at":"2026-07-04T16:29:56.625425Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.25465","last_updated":"2026-06-24T06:45:56Z","snapshot_observed_at":"2026-07-06T23:59:57.346004Z","submitted_at":"2026-06-24T06:45:56Z","title":"EchoStyle: Unlocking High-Fidelity Video Stylization with Reverse Data Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-25T21:00:00.682243Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.25465"},"observation_digest":"sha256:60e476c50c69724fb03113d0365e08c5ea1b68da76574f32b8e6b0aef8a6f015","observation_id":"b50c8d02-3126-4de8-bc5d-c6fa4a48350f","resolution":{"observed_at":"2026-07-04T19:50:10.463713Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.25496","last_updated":"2026-06-24T07:23:20Z","snapshot_observed_at":"2026-07-06T23:59:57.346004Z","submitted_at":"2026-06-24T07:23:20Z","title":"Recommendation as Generation: Unifying Personalized Video Generation and Recommendation at Industrial Scale","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-25T20:21:09.611166Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.25496"},"observation_digest":"sha256:96dd9506892605fe2ac60a031d3369750dd9a8b4609808361921e28ae27b4da0","observation_id":"85a53d0f-e0f0-4493-9dcc-585998181b05","resolution":{"observed_at":"2026-07-04T20:20:07.222572Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2606.26668","last_updated":"2026-06-25T07:01:05Z","snapshot_observed_at":"2026-07-07T00:01:01.437499Z","submitted_at":"2026-06-25T07:01:05Z","title":"Disco-LoRA: Disentangled Composition of Content, Style, and Motion for Multi-concept Video Customization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-26T05:51:29.839498Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2606.26668"},"observation_digest":"sha256:7349e04f096b0ed146a8203609b4bdf6fe144d994f9f9ccd3f5050678af1a6ea","observation_id":"ac06731d-a0d6-430d-99ee-c5e137b67110","resolution":{"observed_at":"2026-07-04T12:49:52.783219Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-07-12T08:04:48.963890Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02642","last_updated":"2026-07-02T17:02:43Z","snapshot_observed_at":"2026-08-03T12:39:47.539491Z","submitted_at":"2026-07-02T17:02:43Z","title":"GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-07-12T08:04:48.963890Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.02642"},"observation_digest":"sha256:5c29da73f71a2282b430bf1303aa4d736fa222315465a4eade546c233445deac","observation_id":"3ee6c78e-d29c-49ef-933b-6163c5dd4389","resolution":{"observed_at":"2026-07-12T08:04:48.963890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2607.06401","last_updated":"2026-07-07T15:31:32Z","snapshot_observed_at":"2026-08-03T02:43:03.919769Z","submitted_at":"2026-07-07T15:31:32Z","title":"A Definition and Roadmap for World Models","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-07-08T07:10:33.826140Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.06401"},"observation_digest":"sha256:b50a2d58d1540f0ae60f5969274eda7755af6e350056d24591f14afbb469ec52","observation_id":"dcee06e9-3192-492c-81f4-8d974de9c2c5","resolution":{"observed_at":"2026-07-08T07:14:44.318385Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-02T04:57:35.730736Z","title":"arXiv preprint arXiv:2512.16776 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13527","last_updated":"2026-07-15T07:26:05Z","snapshot_observed_at":"2026-08-05T04:43:47.810355Z","submitted_at":"2026-07-15T07:26:05Z","title":"VGIF-Score: Interpretable and Diagnostic Evaluation of Spatio-Temporal Instruction Following in Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T04:57:35.730736Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.13527"},"observation_digest":"sha256:49ccc5897aa3b20935c59be5305d906f8c2d0c2a1957094ba98d519c450762dd","observation_id":"3715e158-aaeb-436a-aa84-6400c9d7be47","resolution":{"observed_at":"2026-08-02T04:57:35.730736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-02T03:12:37.050305Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14189","last_updated":"2026-07-15T16:02:45Z","snapshot_observed_at":"2026-08-06T10:03:15.388012Z","submitted_at":"2026-07-15T16:02:45Z","title":"MultiRef-Compass: Towards Comprehensive Evaluation of Multi-Reference-to-Audio-Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T03:12:37.050305Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.14189"},"observation_digest":"sha256:d0536701648e9f8a78639dee1878aa57690c785b69bddd9d56dbaacc645d0446","observation_id":"d2b08512-9b15-4ed8-adba-db19ddd87e4f","resolution":{"observed_at":"2026-08-02T03:12:37.050305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-02T02:56:21.351665Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-06T20:30:20.436321Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:21.351665Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:887dcc642dc5c532c789fa31c84dd7ad1c08e9d82272834dd1fb944e89719b18","observation_id":"bdd143a7-c06b-4e5b-a082-05497918d9a7","resolution":{"observed_at":"2026-08-02T02:56:21.351665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-02T01:27:23.410728Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14681","last_updated":"2026-07-16T07:43:27Z","snapshot_observed_at":"2026-08-06T12:57:36.194341Z","submitted_at":"2026-07-16T07:43:27Z","title":"ReBind: Multi-Reference Video Editing via Structured Instructions with Explicit Reference Relationships","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T01:27:23.410728Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.14681"},"observation_digest":"sha256:f9a748a4f61a8bedb8d9589086f7f995727d81b224037537bd98cf20038b0e09","observation_id":"500b7e07-20d0-45ba-984f-714926347584","resolution":{"observed_at":"2026-08-02T01:27:23.410728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-01T21:07:27.315992Z","title":"Kling-omni technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16401","last_updated":"2026-07-17T18:00:05Z","snapshot_observed_at":"2026-08-02T23:36:27.285941Z","submitted_at":"2026-07-17T18:00:05Z","title":"Apple-$\\pi$: Benchmarking Thinking with Video Towards Law-Grounded Physical Intelligence","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T21:07:27.315992Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.16401"},"observation_digest":"sha256:5c14b1946ba812d7360c8fb8b04812d7e4a6588d8f8772711fd663561634cb33","observation_id":"9bb2b8f0-fd0f-4d55-a062-aa63e9d76b42","resolution":{"observed_at":"2026-08-01T21:07:27.315992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-01T18:33:05.533192Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17279","last_updated":"2026-07-19T14:52:31Z","snapshot_observed_at":"2026-08-01T18:33:02.333809Z","submitted_at":"2026-07-19T14:52:31Z","title":"Between Safe Boundaries: Exploiting Temporal Consistency for Jailbreaking Text-To-Video Generation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T18:33:05.533192Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.17279"},"observation_digest":"sha256:e3baf533723ce2535684b2d46d37ed111576c98f50adf88ef37088751afa93d5","observation_id":"e3a27711-1add-48bb-b82c-e443f1d9b350","resolution":{"observed_at":"2026-08-01T18:33:05.533192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-01T11:22:44.094808Z","title":"arXiv preprint arXiv:2512.16776 (2025) 5, 10, 12","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19923","last_updated":"2026-07-22T08:55:52Z","snapshot_observed_at":"2026-08-06T20:53:51.271362Z","submitted_at":"2026-07-22T08:55:52Z","title":"WearWow: Native 2K Multi-Garment Virtual Try-On via Adaptive Token Packing and Preference Alignment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T11:22:44.094808Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.19923"},"observation_digest":"sha256:a61f450dcb3729068c95d8064aa40eab6d1a0f0c39fb8bb45aa9b604c4cfd62a","observation_id":"d6e3fa2d-59a3-4e2c-b782-8c4c9561174a","resolution":{"observed_at":"2026-08-01T11:22:44.094808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-07-31T20:13:32.367012Z","title":"Kling-omni technical report: A unified framework for video generation, editing, and reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24241","last_updated":"2026-07-29T07:34:35Z","snapshot_observed_at":"2026-08-06T19:54:08.632629Z","submitted_at":"2026-07-27T10:20:31Z","title":"FilmBench: A Film-Grade Benchmark for Cinematic Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T20:13:32.367012Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.24241"},"observation_digest":"sha256:25714fe46f25c6975ca79cf209f536138b42328acd385acd333506f3249f9eb3","observation_id":"d04681d5-6a88-41b7-83c3-9ff59c4894b4","resolution":{"observed_at":"2026-07-31T20:13:32.367012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-07-30T23:47:57.689792Z","title":"Kling-omni technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26694","last_updated":"2026-07-29T09:40:23Z","snapshot_observed_at":"2026-08-04T23:40:40.349276Z","submitted_at":"2026-07-29T09:40:23Z","title":"Visko Orbis 1.0: A Live Model for Real-Time Interactive Long Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T23:47:57.689792Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.26694"},"observation_digest":"sha256:2145bdccd739535196568be300d1c8306afe60659d45f55a9c3337dab66b641b","observation_id":"e1a7e7f4-e501-4ecc-9450-9fbaa40a3b3b","resolution":{"observed_at":"2026-07-30T23:47:57.689792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-07-30T22:05:36.720347Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26754","last_updated":"2026-07-29T10:49:30Z","snapshot_observed_at":"2026-08-06T19:03:18.180608Z","submitted_at":"2026-07-29T10:49:30Z","title":"StatePlay: State-Aware Game World Models for Mechanics-Consistent Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-30T22:05:36.720347Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.26754"},"observation_digest":"sha256:c6f617568705ec9a7a80c43d9400c4bb4f9c009c963cba80fc18544dcd5ccdb3","observation_id":"74ae047d-f6b3-42fb-8d7e-17d0d31b2495","resolution":{"observed_at":"2026-07-30T22:05:36.720347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-03T03:17:57.368025Z","title":"arXiv preprint arXiv:2512.16776 (2025) 2, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29627","last_updated":"2026-07-31T16:59:46Z","snapshot_observed_at":"2026-08-05T23:16:09.548439Z","submitted_at":"2026-07-31T16:59:46Z","title":"FlexComposer: Unified Video Compositing from Images to Dynamic Footage with Flexible Trajectory Control","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T03:17:57.368025Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.29627"},"observation_digest":"sha256:98f714b97d34a44d2876a56784077d17e2e2a79e0cb66a9ce2ee5c3bb3af7474","observation_id":"98f10b05-9921-49c6-9f19-da682e1c75a2","resolution":{"observed_at":"2026-08-03T03:17:57.368025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-04T23:56:50.439438Z","title":"InACM SIGGRAPH 2024 Conference Papers, 1–11","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01628","last_updated":"2026-08-04T03:38:05Z","snapshot_observed_at":"2026-08-07T02:21:52.452815Z","submitted_at":"2026-08-03T02:59:54Z","title":"Motion Beyond Morphology: Bootstrapping Cross-Category Motion Transfer from Abstract Motion Representations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T23:56:50.439438Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2608.01628"},"observation_digest":"sha256:9066fe52494a1e333cee5ba909b8413caa130b79ac280143c1aab5a22a35c559","observation_id":"c7172785-5fb8-4bbf-8b4a-fa933b250cb5","resolution":{"observed_at":"2026-08-04T23:56:50.439438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-07T00:14:49.071339Z","title":"InACM SIGGRAPH 2024 Conference Papers, 1–11","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01628","last_updated":"2026-08-04T03:38:05Z","snapshot_observed_at":"2026-08-07T02:21:52.452815Z","submitted_at":"2026-08-03T02:59:54Z","title":"Motion Beyond Morphology: Bootstrapping Cross-Category Motion Transfer from Abstract Motion Representations","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:49.071339Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2608.01628"},"observation_digest":"sha256:d4a8fddd387333ee3e053e873f7c61fbd247455d1aef5a5425c25744bc024024","observation_id":"dab6ce0b-e025-4be2-89fa-c98e0d1a9c8d","resolution":{"observed_at":"2026-08-07T00:14:49.071339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-06T13:04:14.057803Z","title":"arXiv preprint arXiv:2512.16776 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04956","last_updated":"2026-08-05T15:27:26Z","snapshot_observed_at":"2026-08-07T01:31:35.404552Z","submitted_at":"2026-08-05T15:27:26Z","title":"ContextMaster: Interactive Multi-Shot Video Creation via Fixed-Budget Sparse Context Routing","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T13:04:14.057803Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2608.04956"},"observation_digest":"sha256:d788c2abe9a33057d8f9898a23dd7ebc1a4d56cc960f6ef7c2955d996ff2c1da","observation_id":"6d9e17b0-64a1-41c7-9e8d-66508ea58447","resolution":{"observed_at":"2026-08-06T13:04:14.057803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-06T10:34:42.381600Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T01:31:54.027634Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.381600Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:49bee74a516253fe955a9fd0fb2a8efc217c31f2ea8d5e1e6558ac3ae521e82a","observation_id":"00933cae-4ba2-402d-98a0-749e3ba91d9f","resolution":{"observed_at":"2026-08-06T10:34:42.381600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-06T05:03:07.876295Z","title":"Kling-Omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05115","last_updated":"2026-08-05T17:46:28Z","snapshot_observed_at":"2026-08-07T01:32:02.836092Z","submitted_at":"2026-08-05T17:46:28Z","title":"Robust and Efficient Motion Reasoning for Privacy-Aware Classroom Incident Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:07.876295Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2608.05115"},"observation_digest":"sha256:9b3deb649ea45c35cf4bbefe54a4bf3e5e9b27893607e1f16316d6c848ab5dcb","observation_id":"03aeb951-379c-4b5e-abe5-a8f45417d3c0","resolution":{"observed_at":"2026-08-06T05:03:07.876295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.16776/citation-record","integrity":"/paper/2512.16776/integrity","json":"/paper/2512.16776/citation-record.json","paper":"/paper/2512.16776"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8e788c52-86c4-45b7-8c02-9a9933a4812d","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:5c6db92b642f38753e81407062c699a8e40d5492383b4d67c7ef80b2e19a086f","observation_id":"8aa32ed7-e509-407c-b9ce-15fdaf01c25b","resolution":{"observed_at":"2026-05-15T21:00:58.768824Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:7087a048845a663bdc7bab49ae6a42680f97277e45786d13f6fcc38acd4c9028","observation_id":"f8ba584a-ce80-403c-924a-cced9a3ecadd","resolution":{"observed_at":"2026-05-15T21:00:58.526270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.08930","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From structure to detail: Hierarchical distillation for efficient diffusion model","venue":null,"work_id":"bdb1f4d7-aac5-4797-a6bd-2553e464cb3d","year":2025},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:f4f5c802f5f76427416b80ef2d675808a3984a7036ca27af7c68274fbe3b44a2","observation_id":"51b09077-a490-4015-8152-ebce9986030f","resolution":{"observed_at":"2026-05-15T21:00:58.649065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://deepmind.google/models/gemini-image/pro/","venue":null,"work_id":"578365a4-5faf-4412-8f6e-dc48fca5e015","year":null},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:28a7b68c9c20c61c7b4edbb2db5f47f21bfc8e2d2c1c49e2a3139c747d4b909c","observation_id":"8d795079-0fa2-4c15-899b-e2bdb8e86218","resolution":{"observed_at":"2026-05-15T21:00:58.664264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Patch n’pack: Navit, a vision transformer for any aspect ratio and resolution.Advances in Neural Information Processing Systems, 36:2252–2274","venue":null,"work_id":"af2aa358-10a6-409d-83c1-c2ec6427e78c","year":2023},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:086c3fe91ddc04a59709f5931414bbacae6305d51b902dbecfa859df0bbbb8ca","observation_id":"2df02421-c236-4d79-89a0-9f20620d13ad","resolution":{"observed_at":"2026-05-15T21:00:58.671960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dapple: A pipelined data parallel approach for training large models","venue":null,"work_id":"a94ea43a-dbb0-4f82-9f08-71112cf8b78d","year":2021},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:3378288be1388b6ca918ddc16c4a5f3c15a16a7e4ce28c1a1d45587aacb80917","observation_id":"3795fae5-36d4-4019-81a5-713c1b73d406","resolution":{"observed_at":"2026-05-15T21:00:58.678361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09113","last_updated":"2025-06-28T11:58:23Z","snapshot_observed_at":"2026-08-01T16:09:18.068564Z","submitted_at":"2025-06-10T17:56:11Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","version":2},"cited_work":{"arxiv_id":"2506.09113","doi":"10.48550/arxiv.2506.09113","metadata_source":"pith","pith_arxiv_id":"2506.09113","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","venue":"cs.CV","work_id":"b2e36b5d-99e4-45b4-9358-64f6d3501983","year":2025},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2506.09113","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:d02e4e5cde1440826e4f2a43eb014417cd778a2694119071b702015e8dd11152","observation_id":"125adf6b-0bfc-4c02-ad98-02f062f89d62","resolution":{"observed_at":"2026-05-15T21:00:58.630323Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://aistudio.google.com/models/veo-3","venue":null,"work_id":"1c38ca6f-821c-430b-942f-9a974c2176a0","year":null},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:8ddaba95efa2a94c9fcc44dbd979694f9948dc022862936f24a559e37b7ab359","observation_id":"842375bd-b5cd-42a2-951a-8ce1a40fb8c6","resolution":{"observed_at":"2026-05-15T21:00:58.684078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:a7aaf9d84d63c7105484c8ce769a8a7482ec5649160ac36a33cb762a4c161eaf","observation_id":"7eddbc0a-8973-4737-8561-d409de6d01ae","resolution":{"observed_at":"2026-05-15T21:00:58.638539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02088","last_updated":"2024-01-04T06:23:22Z","snapshot_observed_at":"2026-08-03T22:29:52.962080Z","submitted_at":"2024-01-04T06:23:22Z","title":"Re-evaluating the Memory-balanced Pipeline Parallelism: BPipe","version":1},"cited_work":{"arxiv_id":"2401.02088","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.02088","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Re-evaluating the memory-balanced pipeline parallelism: Bpipe","venue":null,"work_id":"298b116c-b4b2-411b-9e99-67d57cafbb15","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2401.02088","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:7315e7f2a4b94922f6b189977299c77330f301a2ec31e3ee94018e4327f601e5","observation_id":"7d914d6e-c7b1-4d4e-8628-b2e739a8fd7d","resolution":{"observed_at":"2026-05-15T21:00:58.512581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism","venue":null,"work_id":"b982ef98-c4cb-4df7-8fbc-5a4cf7fd97f4","year":2019},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:ca2a9eeeff6c8f976d3cefa9882cc987978b55ade23e16a0ab48b442fe04453e","observation_id":"28a657f0-4e73-4aa0-81bf-5121b9835ea5","resolution":{"observed_at":"2026-05-15T21:00:58.693027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:8878965ccfc5cafb2653fb97c9fdd84335c235e96362652d441a5288c63bbe56","observation_id":"ab1f8824-2af7-4bed-a951-dcba401f8150","resolution":{"observed_at":"2026-05-15T21:00:58.535821Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-04T19:27:31.715261Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"cited_work":{"arxiv_id":"2309.14509","doi":"10.48550/arxiv.2309.14509","metadata_source":"pith","pith_arxiv_id":"2309.14509","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","venue":"cs.LG","work_id":"bb119d0b-c7f0-412a-a426-f74bd6949a51","year":2023},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2309.14509","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:37996d1b55e11a6993b739b8bfbd94b66c6d41af7207780bfd9a1c1a9f85aeb1","observation_id":"5ea5ec2f-7e2b-47d3-bc1d-f102f1711eaa","resolution":{"observed_at":"2026-05-15T21:00:58.544192Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:d2801cffd561d1dff758c42c13c80c7273dbebc5d55f1e133768642d7ea16303","observation_id":"0ff9e3c7-9c33-4d09-93ad-6be7d4c37a99","resolution":{"observed_at":"2026-05-15T21:00:58.554108Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-07-06T16:26:58.234941Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":"2310.01889","doi":"10.48550/arxiv.2310.01889","metadata_source":"pith","pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","venue":"cs.CL","work_id":"982498c4-e80e-4e66-8c44-c60813be298d","year":2023},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:b8ef20da4f82f3488e1f0e24e4e63c387d8502faf5bb7194079fa2af1252a54a","observation_id":"7b3b605e-164b-4613-a9a1-ae2c3a7f1247","resolution":{"observed_at":"2026-05-15T21:00:58.591327Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:24.101224+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:24.101224+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06674","last_updated":"2025-03-12T12:25:18Z","snapshot_observed_at":"2026-07-06T20:49:27.466064Z","submitted_at":"2025-03-09T15:53:49Z","title":"Learning Few-Step Diffusion Models by Trajectory Distribution Matching","version":2},"cited_work":{"arxiv_id":"2503.06674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.06674","snapshot_observed_at":"2026-06-30T23:45:07.785757Z","title":"Learning few- step diffusion models by trajectory distribution matching","venue":null,"work_id":"9a0f72fb-aad5-4746-94ea-ee9f2f29d8b0","year":2025},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2503.06674","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:d2322fea837b0180fc6a40a8e69d958786c72a45bdbb11d878ed6e0e82d2d5ac","observation_id":"de8bf78d-5317-497e-a034-ba0ea9dcd6ea","resolution":{"observed_at":"2026-05-15T21:00:58.622991Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Janusflow: Harmonizing autoregression and rectified flow for unified multimodal understanding and generation","venue":null,"work_id":"2ad6bc55-df62-45b4-871e-9ba0c06c6e01","year":2025},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:830b19325a6343a05837b43618855a79767c849522cedcfd2690c87db65af34e","observation_id":"f071604c-0357-48b5-b40f-e20632e42fa5","resolution":{"observed_at":"2026-05-15T21:00:58.699714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memory-efficient pipeline-parallel dnn training","venue":null,"work_id":"916236f7-6ddc-4bb4-9596-00b984e7bca0","year":2021},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:3bc66a5097703f536f1ecf5781fc48fbcfc09dbd8f9b2c4800f6c60cab00a18f","observation_id":"6f098329-2ce8-4011-a9b4-63b0bf65cb75","resolution":{"observed_at":"2026-05-15T21:00:58.702798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient large-scale language 35 Kling-Omni: Omni Video Generation Model from Multi-modal Visual Language model training on gpu clusters using megatron-lm","venue":null,"work_id":"d0d9dcb0-6826-4b9a-9eb4-ed8cab80fd83","year":2021},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:2665d831511edc0304384aab6ce70ba6ef0a3d81f7dfd53a093150c7d78c4b73","observation_id":"332972c1-b899-4610-bdfa-034de095122d","resolution":{"observed_at":"2026-05-15T21:00:58.707054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T22:47:43.126704Z","title":"Direct preference optimization: Your language model is secretly a reward model.Advances in neural information processing systems, 36:53728–53741","venue":null,"work_id":"d65a86ed-cf86-475e-9502-161e34d6a682","year":2023},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:2d373e374c26a2b819ce076373b2536305fc33854a5163c5dcccd7fc63f4a271","observation_id":"33c9347b-2306-418f-8dfb-8f6ef2c36336","resolution":{"observed_at":"2026-05-15T21:00:58.722788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:53.535179Z","title":"Hyper-sd: Trajectory segmented consistency model for efficient image synthesis.Advances in Neural Information Processing Systems, 37:117340–117362","venue":null,"work_id":"5c02e543-e82f-4379-92e4-c10d4659ee6e","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:3375b3d208c7a5ed9bc598b63b34d6e076273ab15c4b84d8721bb98f5bbb4e48","observation_id":"3954b2fe-847c-4347-8a04-10e63ae73865","resolution":{"observed_at":"2026-05-15T21:00:58.727509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:05:18.649491Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"3cba96fb-e636-4639-8d43-2f25ce21d4d1","year":2022},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:d44fc61b62579cbcc77615ec156c69e9855a575cdaaee713bc8d83c10879ec2e","observation_id":"3d9209df-11bf-4cee-ab9f-fed77faf156a","resolution":{"observed_at":"2026-05-15T21:00:58.734304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://app.runwayml.com/","venue":null,"work_id":"f062b7bb-6666-4573-a485-11a2381c07d7","year":null},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:9d7fa966ee5734ae090c50cd6b979a6a4125b98fddcb58f6977869ed004dc3bc","observation_id":"df4ad247-c0b7-4f78-aac8-1aa6fc5961db","resolution":{"observed_at":"2026-05-15T21:00:58.739812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision.Advances in Neural Information Processing Systems, 37:68658–68685","venue":null,"work_id":"4023f41f-3dcd-46f6-a959-94b75c2aaf24","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:a8c6b93b1c776b400e6b71aa33fa0862aee131d1d976e4e03fd4d4adc886f1d5","observation_id":"cfc6589f-734c-401c-807d-9ae06764e56b","resolution":{"observed_at":"2026-05-15T21:00:58.746070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:d81507dd66abec8deddc3dc386a6a68a52c7ee0c468bf5076fbeb41eddbc6f21","observation_id":"68a295c8-0fdb-4838-a067-9a709dc4b70c","resolution":{"observed_at":"2026-05-15T21:00:58.560870Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":"1909.08053","doi":"10.48550/arxiv.1909.08053","metadata_source":"pith","pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","venue":"cs.CL","work_id":"c888e6d1-0b1d-43d6-9ef5-f0912a0efa1b","year":2019},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:d3c016a6c732edbf2066c183c4513234f56780720bef2e8838fa15aa8e5666d5","observation_id":"835bf4dc-434c-44c6-847a-888a6cb1cd08","resolution":{"observed_at":"2026-05-15T21:00:58.564844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:6b03849c7ffea8bf42b6dae74cb69d3dacb4f5be3def87a0ced192abdc62130f","observation_id":"c000aa46-4f17-4e7f-8ad7-f6159c47dcee","resolution":{"observed_at":"2026-05-15T21:00:58.568481Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.04570","last_updated":"2026-04-07T09:55:11Z","snapshot_observed_at":"2026-07-30T01:17:08.732833Z","submitted_at":"2025-11-06T17:25:23Z","title":"Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm","version":2},"cited_work":{"arxiv_id":"2511.04570","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.04570","snapshot_observed_at":"2026-07-10T01:46:40.976623Z","title":"Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm","venue":"cs.CV","work_id":"b327f866-d49b-4e15-aa3f-68b695fc7e47","year":2025},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2511.04570","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:436bcd3cb6328410ad28b9e8fb96761dce6fe2441b8adbdd98b7fb151f3067eb","observation_id":"bd2e331e-ca62-4140-ac2b-16b475336611","resolution":{"observed_at":"2026-05-15T21:00:58.574782Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:a488e90037c3585be24277816e19781b18bb6c9f233d36159f76020de7a46ca0","observation_id":"9d36a71b-c65d-46cc-9a26-6003b79ae083","resolution":{"observed_at":"2026-05-15T21:00:58.582517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Phased consistency models.Advances in neural information processing systems, 37:83951–84009","venue":null,"work_id":"f4290120-e4f6-4617-aaab-eb8c54fc2931","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:3a2edc753268405f1f7c1465527ff45565f4a87415bd0606811cc37efe167756","observation_id":"4b66eb8b-3ade-4886-a944-393217c72ef0","resolution":{"observed_at":"2026-05-15T21:00:58.751895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6641.371599","doi":"10.1145/3676641.3715996","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the 30th ACM International Conference on Architectural Support for Programming Languages and Operating Systems, Volume 2 , pages =","venue":null,"work_id":"204d9603-476f-4dc9-884a-d132681cee84","year":2025},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:442170708cf6d4f93635d52fa68f747d04f4ddb83dfad97434b3325a11f8f518","observation_id":"dec62a84-973d-460c-9d8a-cfede1181863","resolution":{"observed_at":"2026-05-15T21:00:58.501868Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20328","last_updated":"2025-09-29T20:44:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-24T17:17:27Z","title":"Video models are zero-shot learners and reasoners","version":2},"cited_work":{"arxiv_id":"2509.20328","doi":"10.48550/arxiv.2509.20328","metadata_source":"pith","pith_arxiv_id":"2509.20328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Video models are zero-shot learners and reasoners","venue":"cs.LG","work_id":"6ef44b1c-944f-4648-b3a3-e5c320f385c1","year":2025},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2509.20328","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:45b6773df43ec06821701ed9083f300f927ad473adb0bb1e21ecdfcd199fca0a","observation_id":"7c56be35-e66c-4d41-bbbf-538729048392","resolution":{"observed_at":"2026-05-15T21:00:58.607229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:32.351277+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:32.351277+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:cd47375c5e762173c168f49e7ca31ad35c59aa1d239a43dd03e8fd524972c9be","observation_id":"2360ef54-ac5a-49c8-895d-7d94bda0b68e","resolution":{"observed_at":"2026-05-15T21:00:58.615198Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved distribution matching distillation for fast image synthesis.Advances in neural information processing systems, 37:47455–47487","venue":null,"work_id":"334fa4ff-34f3-4ee8-a60d-cd69a1a1d4a1","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:5271ab4b9f7bc65887cae4bfb44147b94f95d14566b89497c95f9522532977bc","observation_id":"7f8d3868-e576-40be-8e7a-e39864069ee9","resolution":{"observed_at":"2026-05-15T21:00:58.757151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accelerating the training of large language models using efficient activation rematerialization and optimal hybrid parallelism","venue":null,"work_id":"28a35e85-c724-4981-ab04-5a763021224b","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:75aebffa515d2316daa9a85e14eb79b6c7d6e0e4ed9aa4f97d0cf3c2f7ed5132","observation_id":"06fb48d2-6663-4be7-947d-5547bdc06436","resolution":{"observed_at":"2026-05-15T21:00:58.762485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Score identity distillation: Exponentially fast distillation of pretrained diffusion models for one-step generation","venue":null,"work_id":"9d0344bd-9b9c-4d9e-8b8f-b6622c33fd07","year":2024},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:cf4ba46a97d00a77074d056d9d88f2d27b0d752995953415a9f94d2d1c97e262","observation_id":"e8c5f63b-25b7-49a7-8444-be1ac7abd30a","resolution":{"observed_at":"2026-05-15T21:00:58.655591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":17,"verified_fuzzy":17},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 74 inbound Pith citation observations for arXiv:2512.16776."}