{"as_of":"2026-08-06T07:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7bf0d9de748dd6932915c148a788c13d86b653836df0692bf2f9b11e69dd62b9","coverage":[{"denominator":110,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:54:31.472203Z","state":"measured"},{"denominator":106,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":106,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T01:25:15.036619Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T16:44:15.997172Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"cited_work":{"arxiv_id":"2510.08073","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.08073","snapshot_observed_at":"2026-06-11T02:08:35.588817Z","title":"Physics-driven spatiotemporal modeling for ai-generated video detection","venue":null,"work_id":"30167ed9-1199-4e07-a582-2449c300a782","year":2025},"citing_paper":{"arxiv_id":"2512.10248","last_updated":"2026-05-07T00:10:41Z","snapshot_observed_at":"2026-07-06T22:38:40.044448Z","submitted_at":"2025-12-11T03:12:56Z","title":"RobustSora: De-Watermarked Benchmark for Robust AI-Generated Video Detection","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T23:13:02.040618Z"},"links":{"cited_paper":"/paper/2510.08073","citing_paper":"/paper/2512.10248"},"observation_digest":"sha256:791aca6b8227f52b535cc8d6022a469ee6c670f9698bdd4897d95ca3cc70663a","observation_id":"647858d2-7c3b-4155-ac97-1df417327b16","resolution":{"observed_at":"2026-06-11T02:08:35.588817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"cited_work":{"arxiv_id":"2510.08073","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.08073","snapshot_observed_at":"2026-06-11T02:08:35.588817Z","title":"Physics-driven spatiotemporal modeling for ai-generated video detection","venue":null,"work_id":"30167ed9-1199-4e07-a582-2449c300a782","year":2025},"citing_paper":{"arxiv_id":"2512.15693","last_updated":"2026-05-15T14:16:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:48:26Z","title":"Skyra: AI-Generated Video Detection via Grounded Artifact Reasoning","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-21T16:43:11.995960Z"},"links":{"cited_paper":"/paper/2510.08073","citing_paper":"/paper/2512.15693"},"observation_digest":"sha256:893bc399eee09030962a4c7d0dc4bed5928215c4e07ac85787d74602a7130c17","observation_id":"52d4b892-a5f1-49bf-8b21-45219be4ea65","resolution":{"observed_at":"2026-06-11T02:08:35.588817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"cited_work":{"arxiv_id":"2510.08073","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.08073","snapshot_observed_at":"2026-06-11T02:08:35.588817Z","title":"Physics-driven spatiotemporal modeling for ai-generated video detection","venue":null,"work_id":"30167ed9-1199-4e07-a582-2449c300a782","year":2025},"citing_paper":{"arxiv_id":"2604.04608","last_updated":"2026-04-06T11:50:29Z","snapshot_observed_at":"2026-08-06T06:14:55.966523Z","submitted_at":"2026-04-06T11:50:29Z","title":"Beyond Semantics: Uncovering the Physics of Fakes via Universal Physical Descriptors for Cross-Modal Synthetic Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T18:52:34.752473Z"},"links":{"cited_paper":"/paper/2510.08073","citing_paper":"/paper/2604.04608"},"observation_digest":"sha256:b4dffdb379b0140d1599c049b4b3deaec24783fa369596751e80650c1d19dd04","observation_id":"241f442b-5a2a-4142-83e6-86a7804a11a4","resolution":{"observed_at":"2026-06-11T02:08:35.588817Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"cited_work":{"arxiv_id":"2510.08073","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.08073","snapshot_observed_at":"2026-06-11T02:08:35.588817Z","title":"Physics-driven spatiotemporal modeling for ai-generated video detection","venue":null,"work_id":"30167ed9-1199-4e07-a582-2449c300a782","year":2025},"citing_paper":{"arxiv_id":"2605.09296","last_updated":"2026-05-10T03:44:09Z","snapshot_observed_at":"2026-07-31T17:27:24.434233Z","submitted_at":"2026-05-10T03:44:09Z","title":"Micro-Defects Expose Macro-Fakes: Detecting AI-Generated Images via Local Distributional Shifts","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-12T04:30:55.547341Z"},"links":{"cited_paper":"/paper/2510.08073","citing_paper":"/paper/2605.09296"},"observation_digest":"sha256:a0dc6b632d7dc1d3d3d94a3849c2a94ed823ee3e26ee67b205ecb5bfcf5925e7","observation_id":"c50aa85b-6dbc-49b7-ad5e-0055754c472a","resolution":{"observed_at":"2026-06-11T02:08:35.588817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"cited_work":{"arxiv_id":"2510.08073","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.08073","snapshot_observed_at":"2026-06-11T02:08:35.588817Z","title":"Physics-driven spatiotemporal modeling for ai-generated video detection","venue":null,"work_id":"30167ed9-1199-4e07-a582-2449c300a782","year":2025},"citing_paper":{"arxiv_id":"2605.17133","last_updated":"2026-05-16T19:46:33Z","snapshot_observed_at":"2026-08-05T10:23:49.044022Z","submitted_at":"2026-05-16T19:46:33Z","title":"CAM-VFD: Cross-Attention Multimodal Video Forgery Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-20T15:08:25.309094Z"},"links":{"cited_paper":"/paper/2510.08073","citing_paper":"/paper/2605.17133"},"observation_digest":"sha256:46bfde0ef943a9feb014de5b59a86a1d327d34d29ce637112759e4a00962dba2","observation_id":"90a4446a-3e60-41dd-ac2a-74558035e733","resolution":{"observed_at":"2026-06-11T02:08:35.588817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.08073","snapshot_observed_at":"2026-08-02T01:25:15.036619Z","title":"Physics-driven spatiotemporal modeling for ai-generated video detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15321","last_updated":"2026-07-16T07:57:31Z","snapshot_observed_at":"2026-08-05T12:38:48.382944Z","submitted_at":"2026-07-16T07:57:31Z","title":"Rethinking the Readout: Unlocking Video Backbones for AI-Generated Video Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T01:25:15.036619Z"},"links":{"cited_paper":"/paper/2510.08073","citing_paper":"/paper/2607.15321"},"observation_digest":"sha256:e85c53c35e3576f2ce9749e38f02516188b463a82315e83f3efd22884ec80e4b","observation_id":"e0de16d3-6dc9-4b9c-80c8-20bc02f8a2d3","resolution":{"observed_at":"2026-08-02T01:25:15.036619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2510.08073/citation-record","integrity":"/paper/2510.08073/integrity","json":"/paper/2510.08073/citation-record.json","paper":"/paper/2510.08073"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-04T10:54:21.468166Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:21.468166Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:4fb52fd5094123e5181a1d368fe490b22e5a8d40ad85e299faf32eef3e0487f7","observation_id":"5f88d5d2-571e-4e2a-aed7-116d9a92301b","resolution":{"observed_at":"2026-08-04T10:54:21.468166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:21.547748Z","title":"Align your latents: High-resolution video synthesis with latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:21.547748Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:fb111c239aebb57e3c46a3903f3b8339ce1b07626a0ef92e1fb17d66f5e12dd3","observation_id":"ec80c779-1c0c-4ad2-b0bd-ec836f4b1d05","resolution":{"observed_at":"2026-08-04T10:54:21.547748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:21.632993Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:21.632993Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:34ed9fd34ef17fc3c71f7a06aa5619e64af6573d39c506246af13448588e1e01","observation_id":"465b0dd8-59b0-494c-95c2-f278405a1aae","resolution":{"observed_at":"2026-08-04T10:54:21.632993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:21.709205Z","title":"Customcrafter: Customized video generation with preserving motion and concept composition abilities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:21.709205Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:bdef30cf37618a59d0bedd254f754cb309a53ea0843eb7b7b14ab72420e6d523","observation_id":"0ae6343d-b48b-49ac-a7ae-7a2ca8d47183","resolution":{"observed_at":"2026-08-04T10:54:21.709205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:21.781090Z","title":"Unveiling causal reasoning in large language models: Reality or mirage? 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:21.781090Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:0c168c64caeae7871eb616b729d51ac1063ad73b877148d70bb3b5486631ea6e","observation_id":"46f269c0-662a-466d-9680-3907523fd6e4","resolution":{"observed_at":"2026-08-04T10:54:21.781090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:21.864152Z","title":"Fine-grained controllable video generation via object appearance and context","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:21.864152Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:02b83179357358497d2854d6697aa23f69c7e0f08fb7b418492fab97009166e8","observation_id":"4ab95017-a51c-40e7-832c-cf21e2a8c0fb","resolution":{"observed_at":"2026-08-04T10:54:21.864152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:21.998573Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:21.998573Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:0c00c1fef212eaf468104f46027fccf0a9186aea3c4f969826fa29d56551b114","observation_id":"2f318838-3208-4c04-9e0e-dc516002aedf","resolution":{"observed_at":"2026-08-04T10:54:21.998573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:22.105220Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:22.105220Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:e51f4b876d0f6c500c944b7b135ec087ff1d6b51377c9b2b5696106bb9d29917","observation_id":"915c2931-74cc-4da0-a6ba-797240d9952b","resolution":{"observed_at":"2026-08-04T10:54:22.105220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:22.318523Z","title":"Motion-i2v: Consistent and controllable image-to-video generation with explicit motion modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:22.318523Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:bbf31a7ebf46eb798d52eb1690cb593e30241c92c2a8f853c4d611a695391a82","observation_id":"d3ca7eab-c943-43c8-9d62-74fa4912fbad","resolution":{"observed_at":"2026-08-04T10:54:22.318523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:22.491015Z","title":"Image conductor: Precision control for interactive video synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:22.491015Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:58e6d0a3f3e8c6bf94de774d31d0c7d4a5281061e9e6d50d83887e4f1d7bb703","observation_id":"71104791-71b6-4a35-97cf-8831d29df35e","resolution":{"observed_at":"2026-08-04T10:54:22.491015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:22.634749Z","title":"Towards open-set identity preserving face synthesis","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:22.634749Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:2a3963001db03250338f53d172bb4c873329ef4b03e97c91a457720887389ef1","observation_id":"e9490ede-e75d-40e4-8cf2-ccccdd5d8994","resolution":{"observed_at":"2026-08-04T10:54:22.634749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:22.709112Z","title":"Pulid: Pure and lightning id customization via contrastive alignment.Advances in neural information processing systems, 37:36777–36804, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:22.709112Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:7508fe7a86f0bd78fed17573eb2fcb92303484f80210bf582b4a0b8f2d7ccc74","observation_id":"f3273a04-d26c-40e0-b39b-2c2facaa328d","resolution":{"observed_at":"2026-08-04T10:54:22.709112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:22.843524Z","title":"Out-of-distribution detection learning with unreliable out-of-distribution sources","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:22.843524Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:5d9456ce2786a7db9634b905e0ca76b9676bb62174208304998722958b01810f","observation_id":"ec9bebc4-855f-4a9e-8f1f-c4c7449899d1","resolution":{"observed_at":"2026-08-04T10:54:22.843524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:22.959494Z","title":"Hififace: 3d shape and semantic prior guided high fidelity face swapping","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:22.959494Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:55cc477295422e7d2c0cdbe99ec6c24ced24574d51e9842a2a236ad79891d860","observation_id":"15fac398-1edd-4306-a8e1-f3756ed2bd50","resolution":{"observed_at":"2026-08-04T10:54:22.959494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:23.081195Z","title":"Diffswap: High-fidelity and controllable face swapping via 3d-aware masked diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:23.081195Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:4cfa1092ff1b528f0f8591f63a78858a71cd5d6785af255e8ce916da103420fc","observation_id":"958f0a17-2225-4aad-a400-98de53d61a7a","resolution":{"observed_at":"2026-08-04T10:54:23.081195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:23.211613Z","title":"Avff: Audio-visual feature fusion for video deepfake detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:23.211613Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:bd169d80f5793f8f50acb57a1c1e440471e1ca64bd4c495592ed0bb6eddc47c1","observation_id":"82fed9fa-d05c-4cfb-952d-753ad490978b","resolution":{"observed_at":"2026-08-04T10:54:23.211613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:23.328996Z","title":"Learning defense transformations for counterattacking adversarial examples.Neural Networks, 164:177–185, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:23.328996Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:f19445ba64f566c562a8115db45fda7c0cbbb5c13fb92146fd4979162a90f6e2","observation_id":"91360e98-0653-4150-aa13-dd8c78628726","resolution":{"observed_at":"2026-08-04T10:54:23.328996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:23.480810Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:23.480810Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:515ede70cd0c75afa7e6fac495e2f221723fb3db38d4ccab2f12840fbd465eee","observation_id":"7c2f762e-9ff0-4dd3-964e-c7b53284c729","resolution":{"observed_at":"2026-08-04T10:54:23.480810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:23.594547Z","title":"Vbench: Comprehensive benchmark suite for video 11 generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:23.594547Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:191ee1de3dbbfce0c0cef8f72f518b8f90ad08839401939eb17d3d39af71be29","observation_id":"636ee4e8-2ae0-4917-b791-b5f7ec67c400","resolution":{"observed_at":"2026-08-04T10:54:23.594547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-08-04T10:54:23.761559Z","title":"Vbench-2.0: Advancing video generation benchmark suite for intrinsic faithfulness.arXiv preprint arXiv:2503.21755, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:23.761559Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:e88c5e13a99e3f0afb92017cc117a50e67916bb0a632ca25d36ad8fa6166346a","observation_id":"48d2e080-75c0-4e5b-958c-96f9626c6c8c","resolution":{"observed_at":"2026-08-04T10:54:23.761559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:23.912764Z","title":"Codef: Content deformation fields for temporally consistent video processing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:23.912764Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:130c80b7470a5e32c7cf525e5d7a747497fe348667548bc034dfc0b3eea6fcb2","observation_id":"d5318242-70cf-4994-937e-f28fc8a64dfc","resolution":{"observed_at":"2026-08-04T10:54:23.912764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:24.037041Z","title":"Deepfake video detection through optical flow based cnn","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:24.037041Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:876872088beffa347d7de3388d8448ee81168f5a26d2ba913a9cf8b38a284dd7","observation_id":"bf4352af-e07e-4872-9e39-feed1fdfccea","resolution":{"observed_at":"2026-08-04T10:54:24.037041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:24.215386Z","title":"Altfreezing for more general video face forgery detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:24.215386Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:1fb95077c62a3cc1ca70dcfc64a7f1d6f0c359cdf66031912ad5483773f20e2f","observation_id":"df9b7ba5-460a-40ad-b29f-b8d35ed1a2e1","resolution":{"observed_at":"2026-08-04T10:54:24.215386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:24.313597Z","title":"Tall: Thumb- nail layout for deepfake video detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:24.313597Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:246c864c32bcd96f5e58015a669b4d0a35e2b10248fdda29e7248777fe2f9b6b","observation_id":"663191f7-77cf-4bc6-8607-fae2362c1e07","resolution":{"observed_at":"2026-08-04T10:54:24.313597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19707","last_updated":"2024-08-22T09:48:49Z","snapshot_observed_at":"2026-07-06T18:22:27.156635Z","submitted_at":"2024-05-30T05:36:12Z","title":"DeMamba: AI-Generated Video Detection on Million-Scale GenVideo Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19707","snapshot_observed_at":"2026-08-04T10:54:24.450462Z","title":"Demamba: Ai-generated video detection on million-scale genvideo benchmark.arXiv preprint arXiv:2405.19707, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:24.450462Z"},"links":{"cited_paper":"/paper/2405.19707","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:6c3522a3c96253e81eb4401d7fa6eca30dd0ddecd2275df58050f52f04a096aa","observation_id":"649abd61-a224-4648-8169-7ebd449cf827","resolution":{"observed_at":"2026-08-04T10:54:24.450462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:24.585747Z","title":"Thinking in frequency: Face forgery detection by mining frequency-aware clues","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:24.585747Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:f18ea0ed458dd77f9c9df6cea2c2438f239a6ff048fe4f61555a3c4d4a342079","observation_id":"2a8556cb-95a3-4ee7-8a82-ad40252eeddd","resolution":{"observed_at":"2026-08-04T10:54:24.585747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:24.674433Z","title":"Rethinking the up-sampling operations in cnn-based generative network for generalizable deepfake detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:24.674433Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:c9a327cb105796579e543e8503e3810ee3cd2f072a5391623a086c33b956cd17","observation_id":"fb555115-e2ac-4052-b37a-4c640d858247","resolution":{"observed_at":"2026-08-04T10:54:24.674433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:24.790442Z","title":"Cambridge university press, 2000","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:24.790442Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:ec9266e7ab0b10b1f6908a02f39b702724b1a92f4e2398043aa0100801261ff1","observation_id":"b04ea9dc-7981-45c5-8793-eb9b7230508c","resolution":{"observed_at":"2026-08-04T10:54:24.790442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:24.928224Z","title":"Springer, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:24.928224Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:5f040c982b561d190373cd0853d680fd2c809aa53e4eb4bdf82071c3ce57d517","observation_id":"fa67c81b-7b58-42f3-8b8d-a29d7cd39a35","resolution":{"observed_at":"2026-08-04T10:54:24.928224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:25.019696Z","title":"Generative modeling by estimating gradients of the data distribution.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.019696Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:31f33d308e7319fd62656a1a2417c4861dd519dda5ca3b85f8ea65720ef261fd","observation_id":"2131ec22-8150-48bf-8873-5b73ede9df71","resolution":{"observed_at":"2026-08-04T10:54:25.019696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:25.105029Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.105029Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:db0b0a01ec22a7426b997cc0a3dea7c17af8ae1a25c16484a2e2b6682cd8ab31","observation_id":"7b32245d-b2fb-4fe4-b22d-4f34ede7e2fe","resolution":{"observed_at":"2026-08-04T10:54:25.105029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:25.307438Z","title":"Determining optical flow.Artificial intelligence, 17(1-3):185–203, 1981","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.307438Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:2a6269b79cd12fc25385b0212e7bd0d3a32b55259f387a1ed9c6fb0adefe0092","observation_id":"b61e54d8-b881-4aa1-b9f7-5d54f0911c37","resolution":{"observed_at":"2026-08-04T10:54:25.307438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:25.426368Z","title":"A kernel two-sample test.Journal of Machine Learning Research, 13(1):723–773, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.426368Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:b6e2bb1809d2fd78bad1716b94b840e7c374a71baf48c5b67e2701e17815b596","observation_id":"c44dc053-21e2-4e70-aadc-a9c975384964","resolution":{"observed_at":"2026-08-04T10:54:25.426368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:25.552829Z","title":"Learning deep kernels for non-parametric two-sample tests","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.552829Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:7d2dffac3275c6b0759935914d8e98481e36e84d2bf43a17a6b5c4dfba69a70d","observation_id":"38608f25-0916-4a61-b8c4-98aa3b54784b","resolution":{"observed_at":"2026-08-04T10:54:25.552829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:25.649057Z","title":"Exposing deep fakes using inconsistent head poses","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.649057Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:78b34b28dd5c1f8ab89da0fabc82e4f86c055ed4145d241936fd06bb2c1690e5","observation_id":"98d5e5c6-1662-41b3-a25e-48e8e9e3a8b9","resolution":{"observed_at":"2026-08-04T10:54:25.649057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:25.742818Z","title":"Spatiotemporal inconsistency learning for deepfake video detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.742818Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:69968870e308106d775c3378c2f0aec0dda9ec97bbe021c9b7dac2072adae1ac","observation_id":"2ba17429-00ad-4235-ab4a-0d757f95348f","resolution":{"observed_at":"2026-08-04T10:54:25.742818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:25.826140Z","title":"Where deepfakes gaze at? spatial-temporal gaze inconsistency analysis for video face forgery detec- tion.IEEE Transactions on Information Forensics and Security, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.826140Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:8d788b4d4e25b83c6cae35116fa7f9c70114d0f920ac0a51a94fca761f9e57ea","observation_id":"faead1a7-cb89-4522-92ba-4c6ccf4c6ebe","resolution":{"observed_at":"2026-08-04T10:54:25.826140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:25.900898Z","title":"Ai-generated video detection via spatial- temporal anomaly learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.900898Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:ea89499550c60082f309be4143d29f4a6e1bb2280328ea9c2dbbf3d56fcd72b5","observation_id":"7c422ce8-0f57-48ea-89df-1e74f39fd59b","resolution":{"observed_at":"2026-08-04T10:54:25.900898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02085","last_updated":"2025-04-20T11:47:02Z","snapshot_observed_at":"2026-07-06T17:24:49.522453Z","submitted_at":"2024-02-03T08:52:06Z","title":"Detecting AI-Generated Video via Frame Consistency","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02085","snapshot_observed_at":"2026-08-04T10:54:25.976127Z","title":"Decof: Generated video detection via frame consistency: The first benchmark dataset.arXiv preprint arXiv:2402.02085, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:25.976127Z"},"links":{"cited_paper":"/paper/2402.02085","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:4c5787021c7017e19337a458ad2a2550381b53fe5bb7d3b0d8019d1e8ba86fe4","observation_id":"d12619cd-f261-4624-a8b0-5c3cd252d75c","resolution":{"observed_at":"2026-08-04T10:54:25.976127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.097395Z","title":"On learning multi-modal forgery representation for diffusion generated video detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.097395Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:7210403f33e7d3ba789d658f56830e25499f29ea553188290511d2360ade95ec","observation_id":"4120d616-665d-4b2e-b2c4-2ae2e939e1b0","resolution":{"observed_at":"2026-08-04T10:54:26.097395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.169731Z","title":"Denoising diffusion probabilistic models.Advances in Neural Information Processing Systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.169731Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:ed89e8e868ee3170890a70da8cf4d644f354b9fd9cb4f80558ecbd4debaab63d","observation_id":"bf73d0fd-be68-4da3-ad71-15dfe4a8fd73","resolution":{"observed_at":"2026-08-04T10:54:26.169731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.227531Z","title":"Improved techniques for training score-based generative models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.227531Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:8ad2a2473cf8d3a8ebe3393a5cb70d6f8ba256ef7985609a526326c047751b25","observation_id":"ea88b0dc-a71a-4e46-bb96-dcbd0d0ba59c","resolution":{"observed_at":"2026-08-04T10:54:26.227531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.305209Z","title":"Diffusion models for adversarial purification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.305209Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:42003e5891a28f004bbfc9ccf8a6be86a6da64175ad467d48d8638cce4ace7b5","observation_id":"a7f71583-86b8-4327-961a-b20cd00bcf3c","resolution":{"observed_at":"2026-08-04T10:54:26.305209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.442985Z","title":"Adversarial purification with score-based generative models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.442985Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:ef4d2f849a2fa33f38d89c2778c8e39c9c28a8e184264456c5a46231f2e679d9","observation_id":"b3ab81eb-3438-4a6d-b416-a1ee9defcb0c","resolution":{"observed_at":"2026-08-04T10:54:26.442985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.555145Z","title":"Detecting adversarial data by probing multiple perturbations using expected perturbation score","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.555145Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:980d0299fc97a156bf96c0df173856eddf900a5cf850cd6d04934631e5489277","observation_id":"fc6d8d99-c7d9-4463-9fd2-234961380a06","resolution":{"observed_at":"2026-08-04T10:54:26.555145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.625869Z","title":"Deep kernel relative test for machine-generated text detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.625869Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:9d96a7fa6e01c5b0107322d762ed032d4cef6aea4f81128c88f6eaa4591fad0a","observation_id":"ae203cef-1a61-48fc-88db-3f20712af6a0","resolution":{"observed_at":"2026-08-04T10:54:26.625869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.716278Z","title":"Dire for diffusion-generated image detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.716278Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:d50482e6747a2e37be59a943b4c5a14eeb38323a3a2389a7ade082b2ef232197","observation_id":"858ab2e1-8288-4e27-ba86-6a9bd8f12871","resolution":{"observed_at":"2026-08-04T10:54:26.716278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.799890Z","title":"Detect- ing machine-generated texts by multi-population aware optimization for maximum mean discrepancy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.799890Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:c8c29f20c658a1075de156f2f40c48b04cb8c8b93f6ff70d526360f6d206b456","observation_id":"9dd74de3-88e9-4782-bfdb-aedd689f9174","resolution":{"observed_at":"2026-08-04T10:54:26.799890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.857156Z","title":"Generating long videos of dynamic scenes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.857156Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:dbbf2cfc5c22813be448797e0447aacf5e071479c2a9dbff2811f6b9d7673a73","observation_id":"c84ea576-d46b-4fa7-af26-44cf2786313c","resolution":{"observed_at":"2026-08-04T10:54:26.857156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:26.960440Z","title":"Quantum field theory.Reviews of Modern Physics, 71(2):S85, 1999","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:26.960440Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:705726a8b25a8262169cc0aa3cde07d5418d1e1d2c16fffbe47f7a8228ab31b6","observation_id":"b0cc22a9-e6ec-458b-ace2-0403aa35c11b","resolution":{"observed_at":"2026-08-04T10:54:26.960440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.038456Z","title":"Courier Corporation, 1978","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.038456Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:e2245d32fc567158b198950889c510522454f2ae8ca1b537e5c7975a878f759f","observation_id":"3a45fa1b-76ec-40e1-b26e-cdef9b33c446","resolution":{"observed_at":"2026-08-04T10:54:27.038456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.126879Z","title":"Electron spin and probability current density in quantum mechanics.American Journal of Physics, 82(7):681–690, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.126879Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:91c0a201ae28090616ebe30b5ab11b92d4f62222d89bcc63701f17b7fa5d1ea8","observation_id":"ceb8a45c-7711-4a71-925b-8eda6fd9b098","resolution":{"observed_at":"2026-08-04T10:54:27.126879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.215629Z","title":"Fokker-planck equation","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.215629Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:da9735f37aec01619ac4f8df0558a5a016d20fbd9ebc85d0b6d98c3861bfcca8","observation_id":"af7b6d35-6ce1-4ed6-ba50-f3a93f7a3b33","resolution":{"observed_at":"2026-08-04T10:54:27.215629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.355107Z","title":"John Wiley & Sons, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.355107Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:0f0d5464088fb8241b682980f378091d323353f3a4cbc0d3cbe079a2595e6a25","observation_id":"4fa8ac82-79b9-4db4-b45a-6dd51ff428b8","resolution":{"observed_at":"2026-08-04T10:54:27.355107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.418821Z","title":"Springer Science & Business Media, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.418821Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:4ac58d873d17b11b179282fa161c2ee37fc867a92226f09097c4861dba338390","observation_id":"e6bf4dfb-d6ef-4794-be94-9f32fe04ea67","resolution":{"observed_at":"2026-08-04T10:54:27.418821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.535623Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.535623Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:c732f3650813a94858b6270169df1f1632f78c64b3590c09475d13b332e2438e","observation_id":"f4d2420a-bebf-4fe7-98f4-4a02d9fb202f","resolution":{"observed_at":"2026-08-04T10:54:27.535623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.632604Z","title":"Maximum mean discrepancy test is aware of adversarial attacks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.632604Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:2833018b5f259b360f4457d5685cb44e7a18d8d01747a69645c07a590ba6c61f","observation_id":"924c642b-3c6d-4073-b630-97dcc419c89d","resolution":{"observed_at":"2026-08-04T10:54:27.632604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.750521Z","title":"Detecting adversarial data by probing multiple perturbations using expected perturbation score","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.750521Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:fdddeb8b283f1d036a63a46ef2ede3390d0ac50caaf70c5510ff2149e83ceea5","observation_id":"f49b2903-5829-4cd5-a046-aad6f2da23c9","resolution":{"observed_at":"2026-08-04T10:54:27.750521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.831063Z","title":"Toward understanding generative data augmentation.Advances in neural information processing systems, 36:54046–54060, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.831063Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:8340e4b6aae379d00074f6829900379b301d47a8c8c369c08db0b6a821de594e","observation_id":"f6681dd2-02e3-4d08-ba9a-fa15abd4775c","resolution":{"observed_at":"2026-08-04T10:54:27.831063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:27.983515Z","title":"Embedding trajectory for out-of-distribution detection in mathematical reasoning.Advances in Neural Information Processing Systems, 37:42965–42999, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:27.983515Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:c97b6f2c9add2a2b97e4e9ac810a17a842d05be0b623dc7f8268a648768edb51","observation_id":"3ebe80a8-16c1-4284-82f9-4f25f65c81c1","resolution":{"observed_at":"2026-08-04T10:54:27.983515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:28.044315Z","title":"Approximate formulae for the percentage points and the probability integral of the non-centralχ2 distribution.Biometrika, 41(3/4):538–540, 1954","venue":null,"work_id":null,"year":1954},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:28.044315Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:87a267f3e75c9406dbe0100d4aee61acb15628b9f70f9a6b63c36755c207409f","observation_id":"e5f04858-a310-415c-97f3-d75307f4fcc7","resolution":{"observed_at":"2026-08-04T10:54:28.044315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-07-06T05:43:22.028213Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-04T10:54:28.189233Z","title":"The kinetics human action video dataset.arXiv preprint arXiv:1705.06950, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:28.189233Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:242bbfa9dc7261aebf1dc76cfaf7df4aa19ede59d3d82a7601325926817dcca4","observation_id":"3b210bcb-ab0d-444c-9b1b-05a6d7ecb898","resolution":{"observed_at":"2026-08-04T10:54:28.189233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:28.296619Z","title":"Seine: Short-to-long video diffusion model for generative transition and prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:28.296619Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:ead17059a15568c23abaf6095dda734a125d94ce86a258f590856feaa3624e24","observation_id":"fa1366fa-c51e-4a8d-9d69-7f7b1b376bc4","resolution":{"observed_at":"2026-08-04T10:54:28.296619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:28.406702Z","title":"Pika: Empowering non-programmers to author executable governance policies in online communities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:28.406702Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:3b4254de4962d81058b167a60640b3ee69ffd4b1077113a6b5c74415b148fe1f","observation_id":"1adb3f16-1830-415e-bbf6-2e195ac99d7e","resolution":{"observed_at":"2026-08-04T10:54:28.406702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:28.509959Z","title":"Msr-vtt: A large video description dataset for bridging video and language","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:28.509959Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:8e6b030549fe877fd9d973c904f7592a510f0d2ee774fae277a4b0b5fdf5345a","observation_id":"cb4aa034-6f70-4afa-b041-2cd3f9d4d908","resolution":{"observed_at":"2026-08-04T10:54:28.509959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:28.617213Z","title":"Muc-5 evaluation metrics","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:28.617213Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:2debf16d0d9b7f0a22acc7f1a12ca92b83d93f501857d8c00128d4378e8b2549","observation_id":"697655e7-27f2-46f3-ad7b-e47876105d7f","resolution":{"observed_at":"2026-08-04T10:54:28.617213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:28.705509Z","title":"Using auc and accuracy in evaluating learning algorithms","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:28.705509Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:8b26cc66b132f3317721c2521ab7ddad28dd75d9a2b488e677a46f0335b970e9","observation_id":"6b999a9a-e006-418d-bfbc-c318e4f45937","resolution":{"observed_at":"2026-08-04T10:54:28.705509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:28.876468Z","title":"Minimum contrast estimators on sieves: exponential bounds and rates of convergence","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:28.876468Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:c7680c32926282590e0198772b13b78449a5bcf95eddb957939d1b8a7e54ccbd","observation_id":"1bb09417-73a8-4df0-8673-40c0343daeb3","resolution":{"observed_at":"2026-08-04T10:54:28.876468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:28.938627Z","title":"Kernel-based tests for likelihood-free hypothesis testing.Advances in Neural Information Processing Systems, 36:15680–15715, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:28.938627Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:c6aa5017a0e21a402590c425bcbc032e2f51f9861c217662a0dbc3d9c22c4758","observation_id":"13ec6c60-626c-464a-b404-b2bf302381ae","resolution":{"observed_at":"2026-08-04T10:54:28.938627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:29.053317Z","title":"Nyström m-hilbert-schmidt independence criterion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.053317Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:fc487142c4f638fb4e33b8c86416f0ce28cc174ef09a5a90c1e5b06a2c7b4807","observation_id":"a6f20223-b742-42c9-b1dc-4749e971720a","resolution":{"observed_at":"2026-08-04T10:54:29.053317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:29.186510Z","title":"Trustworthy machine learning: From data to models.Foundations and Trends® in Privacy and Security, 7(2-3):74–246, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.186510Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:9c068f91d7820fa06d43f6463fd399a172c012379b13f470cf2f16c4dee0baa3","observation_id":"21347c84-9226-47c1-a023-45428b380389","resolution":{"observed_at":"2026-08-04T10:54:29.186510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:29.300124Z","title":"Integral probability metrics and their generating classes of functions.Advances in applied probability, 29(2):429–443, 1997","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.300124Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:14e3661f7530e4b44b8e716366aa0cfb0542a8538fcce3c95c7c4e976e13e4fb","observation_id":"70dbcb64-f7ec-4826-a43a-802083867e79","resolution":{"observed_at":"2026-08-04T10:54:29.300124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:29.401492Z","title":"Cheung, and James T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.401492Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:fa07caa0f8741c69b3053f134697dac4409c813a9c1c9be6d0ba5aad42044927","observation_id":"9062c142-8022-4e38-b85d-b2e39779ab08","resolution":{"observed_at":"2026-08-04T10:54:29.401492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:29.464609Z","title":"Minimax estimation of maximum mean discrepancy with radial kernels.Advances in Neural Information Processing Systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.464609Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:dc6f5b362324e931ee538cb236bdf9888c83ccf71402d730c825e40e60c4cac6","observation_id":"6a8ac021-72a9-47ab-9190-29b4347dd5c4","resolution":{"observed_at":"2026-08-04T10:54:29.464609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:29.537308Z","title":"Minimax optimality of permuta- tion tests.The Annals of Statistics, 50(1):225–251, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.537308Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:20e2b9f66dcfe3d7e12c76f277a35327baf7af174095f88dd341b14cf6224a62","observation_id":"217faeaa-35bf-44e8-9c03-aad1755f51dd","resolution":{"observed_at":"2026-08-04T10:54:29.537308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04362","last_updated":"2023-06-07T11:52:36Z","snapshot_observed_at":"2026-07-06T15:39:41.431581Z","submitted_at":"2023-06-07T11:52:36Z","title":"Youku-mPLUG: A 10 Million Large-scale Chinese Video-Language Dataset for Pre-training and Benchmarks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04362","snapshot_observed_at":"2026-08-04T10:54:29.611312Z","title":"Youku-mplug: A 10 million large-scale chinese video-language dataset for pre-training and benchmarks.arXiv preprint arXiv:2306.04362, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.611312Z"},"links":{"cited_paper":"/paper/2306.04362","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:ef209ab9ec8d927efa07aaa9cdb4fed0a188689bf2d69a693525c36059ccb940","observation_id":"db9c54da-b929-4ebf-97e6-73ec42ea623b","resolution":{"observed_at":"2026-08-04T10:54:29.611312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:29.698807Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.698807Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:b1f52c1c90dbe0bad62aff6813bd116d1f68c3a0ce48addd128f04ff83b9b243","observation_id":"2bc2342b-9870-4c2c-a251-400a488739fb","resolution":{"observed_at":"2026-08-04T10:54:29.698807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-04T10:54:29.734414Z","title":"I2vgen-xl: High-quality image-to-video synthesis via cascaded diffusion models.arXiv preprint arXiv:2311.04145, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.734414Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:cc2155074979a21fd878e8bd9c1067a6f21cd033764345081a7a0d82fc927646","observation_id":"b3e55f4d-f54b-4c95-9429-87e91f8fed4e","resolution":{"observed_at":"2026-08-04T10:54:29.734414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:29.818894Z","title":"Pia: Your person- alized image animator via plug-and-play modules in text-to-image models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.818894Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:6bb83152f8b22ce977dd58e8b620bb49a9f6fc38d3969201c917bc69b6305149","observation_id":"b77a58fe-04bb-43b0-95c2-d1b7c9a02553","resolution":{"observed_at":"2026-08-04T10:54:29.818894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-02T13:01:06.918463Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-04T10:54:29.887390Z","title":"Latte: Latent diffusion transformer for video generation.arXiv preprint arXiv:2401.03048, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.887390Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:d13831c816e8f75784c8719fcc200f9d10bc9c57d43ba90ed73cee8ea9e19cc8","observation_id":"f650d9b2-fe7a-487c-b4ff-083162ede5e1","resolution":{"observed_at":"2026-08-04T10:54:29.887390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-04T10:54:29.953030Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:29.953030Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:8b55a1d5737d622b4dc38045cb458d2ff3be650732ca1830103595774b0ea62a","observation_id":"872169dc-ed8a-4c2c-a117-25ec7130c610","resolution":{"observed_at":"2026-08-04T10:54:29.953030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-07-06T16:05:35.645037Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-04T10:54:30.014951Z","title":"Modelscope text-to-video technical report.arXiv preprint arXiv:2308.06571, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.014951Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:7aef78351ffa1681379ecbeb4b1e3f9d6b9188660b2b7ccb236839e98a3bb5a9","observation_id":"54d88211-86b0-486b-9f2a-54317b8e2434","resolution":{"observed_at":"2026-08-04T10:54:30.014951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.102568Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.102568Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:b8b4538db6cd7fd6c3de4f25854471f1f5d4bd59471bb49a287a87b72638a8ef","observation_id":"fde35ad6-885c-4ad5-a9da-52ed302f6c94","resolution":{"observed_at":"2026-08-04T10:54:30.102568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.159696Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.159696Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:7061b2366c6ffb6e677051d1bb6381bb361dc4802975c730111f399bce76f32d","observation_id":"42363d8c-c084-4deb-bf3a-8ae9b6c419c3","resolution":{"observed_at":"2026-08-04T10:54:30.159696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.218714Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.218714Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:b84bb1b647301481ab37711c20c61f034bc6bc84135a60c0df4357af6d70d21c","observation_id":"393b5610-9f2c-47ca-b438-28ce182f4b8e","resolution":{"observed_at":"2026-08-04T10:54:30.218714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-04T10:54:30.288405Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.288405Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:45fdcc7396fad6fe49d91d2acd31b61704dba15696c4a91586bd8699c0874f71","observation_id":"51055e20-7b89-49ed-ab5a-e87a72efd481","resolution":{"observed_at":"2026-08-04T10:54:30.288405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.340544Z","title":"Lavie: High-quality video generation with cascaded latent diffusion models.International Journal of Computer Vision, pages 1–20, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.340544Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:0630e8f209dbe490ab08092181044fe93f6c6f73a240b7d7c4f8590444a6d4d6","observation_id":"7376dd21-eba0-41ad-862a-cf14287fe3e9","resolution":{"observed_at":"2026-08-04T10:54:30.340544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.414793Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.414793Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:31ef35dac20289c4c5028e246f961f05e1883b7f7c1399a109a46636aafebc95","observation_id":"4851f20b-7935-4fbb-894f-869c9cc81c14","resolution":{"observed_at":"2026-08-04T10:54:30.414793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.481166Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.481166Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:0ee7b415a24f3f61e756c806f5fb5ff3830491319daa1ace54bff808d46b73b7","observation_id":"c8290bc3-399c-4e73-ac8d-709786e1e801","resolution":{"observed_at":"2026-08-04T10:54:30.481166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.570847Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.570847Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:8dca21a953a3439e88e9fe3935dc81b61a95215ac08177032451399ba4a9b0a7","observation_id":"26531c01-f346-4980-b27e-1eb04c9612f5","resolution":{"observed_at":"2026-08-04T10:54:30.570847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.672212Z","title":"Structural pruning for diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.672212Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:264cdc3731eef85c108d4dd34e9bff3b111cf1edba691dd30fce4b4e3fc73805","observation_id":"99b94077-33d1-4e44-b852-087a632a16d0","resolution":{"observed_at":"2026-08-04T10:54:30.672212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.727547Z","title":"Ptq4dit: Post- training quantization for diffusion transformers.Advances in Neural Information Processing Systems, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.727547Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:fa71b0db3b9987b3401975c7d6311418d8c70375e44fa58eade8651f5991d856","observation_id":"7cc4b9e8-a6c0-4fe3-91d1-6dcb67279655","resolution":{"observed_at":"2026-08-04T10:54:30.727547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.798523Z","title":"Svdqunat: Absorbing outliers by low-rank compo- nents for 4-bit diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.798523Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:fcd3008ef7e0c48385505e03ef2bd2dc4f9a438e3503990e7eaab21032b07f31","observation_id":"c3ba11db-48ff-4087-a1d8-6e29b26b95d2","resolution":{"observed_at":"2026-08-04T10:54:30.798523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.882099Z","title":"Mobilediffusion: Instant text-to-image generation on mobile devices","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.882099Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:2a4beb8300ffe215d8ce1c3ed6eaf85680d6ab98e43705a3d03dd54394118bf5","observation_id":"c3f2a8d0-e617-4294-bb4f-c9ea8f5f7c4a","resolution":{"observed_at":"2026-08-04T10:54:30.882099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:30.953806Z","title":"Light-t2m: A lightweight and fast model for text-to-motion generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.953806Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:3547d3db6c08d941f557e65f611b8f8166ad7c75e88959519bcbbe815d0a9eee","observation_id":"57b28108-32f1-4ef2-95e5-915a5053cc8b","resolution":{"observed_at":"2026-08-04T10:54:30.953806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:31.092372Z","title":"Difffit: Unlocking transferability of large diffusion models via simple parameter- efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:31.092372Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:b4fb998731bc32aa704782e1e3dc8ff478e48f1bc941f6f70b7df54c7c1d16c1","observation_id":"f45bfda7-4aa4-4952-8d8d-432903d3871b","resolution":{"observed_at":"2026-08-04T10:54:31.092372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:31.164980Z","title":"Deft: Efficient fine-tuning of diffusion models by learning the generalised h-transform.Advances in Neural Information Processing Systems, 37:19636–19682, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:31.164980Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:494cf760f767fdcb733d8e80729f08676338bd34ca87faf589c0f4554bba790f","observation_id":"32717a06-5e0d-477a-8c72-eb92d4eeb510","resolution":{"observed_at":"2026-08-04T10:54:31.164980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:31.247921Z","title":"Domain generalization enables gen- eral cancer cell annotation in single-cell and spatial transcriptomics.Nature Communications, 15(1):1929, 2024","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:31.247921Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:9cabb56b181f372bece61f86d51473dac61ba3b91471befb3c13111f04bfc0ed","observation_id":"50218d55-dc27-44cc-a5aa-d4c4212e6ba5","resolution":{"observed_at":"2026-08-04T10:54:31.247921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:31.359938Z","title":"Deep transfer learning enables lesion tracing of circulating tumor cells.Nature Communications, 13(1):7687, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:31.359938Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:0f3d47141d0a8f4bfc52289943f90f80f3aabdbe4c5675a4353d893fe984a9a2","observation_id":"5873584b-9bdc-4b94-8098-18f9b57cc58f","resolution":{"observed_at":"2026-08-04T10:54:31.359938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:31.472203Z","title":"Deepcache: Accelerating diffusion models for free","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:31.472203Z"},"links":{"citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:9408a83c56fcdc4f85c28f9b547219fcb4477cdcaa8b31131bfca8b71c6ce014","observation_id":"7063520f-55b9-4040-a560-172a5712e747","resolution":{"observed_at":"2026-08-04T10:54:31.472203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":110},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 100 of 110 outbound references and 6 inbound Pith citation observations for arXiv:2510.08073."}