{"as_of":"2026-08-06T12:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9f6a4d4623551918ada96462577ab7d68a7a29163fd647e97da86ad980188ad0","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:29:22.711855Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:29:22.711855Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-11T00:30:53.017290Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"cited_work":{"arxiv_id":"2604.07741","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07741","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","venue":"cs.CV","work_id":"f4904ea7-8c61-4ae5-a552-38483e12636a","year":2026},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"cited_paper":"/paper/2604.07741","citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:ad2e40115ceddbecc4f3e3665075cad659345902199ca25a9e3dc17cabb651c0","observation_id":"e7530bde-03c6-45a2-aa59-9f40b9c00b51","resolution":{"observed_at":"2026-05-11T00:30:53.024395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.07741/citation-record","integrity":"/paper/2604.07741/integrity","json":"/paper/2604.07741/citation-record.json","paper":"/paper/2604.07741"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b46ef2ae-c53c-49ba-8ad4-7202fa3d85e9","year":null},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:4fffb89a1630e5b7e9eebf5b913f71c574bbd4d519e6f5c48fbcdc4ab9d2ff9f","observation_id":"6301efbe-5946-455e-869e-50d463c3344c","resolution":{"observed_at":"2026-05-17T02:31:27.791492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chugh et al","venue":null,"work_id":"22f83aea-bcb5-4bff-8d53-7528f7577ab2","year":null},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:6db9c020560613feb9c41e58521c3ed2dc82b6df528113914ed44c8f0f9bbac7","observation_id":"536436d0-087f-4c3f-8832-9dc1571f79a2","resolution":{"observed_at":"2026-05-17T02:31:27.810330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"cited_work":{"arxiv_id":"2604.07741","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07741","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","venue":"cs.CV","work_id":"f4904ea7-8c61-4ae5-a552-38483e12636a","year":2026},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"cited_paper":"/paper/2604.07741","citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:ad2e40115ceddbecc4f3e3665075cad659345902199ca25a9e3dc17cabb651c0","observation_id":"e7530bde-03c6-45a2-aa59-9f40b9c00b51","resolution":{"observed_at":"2026-05-11T00:30:53.024395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Built on this framework, we focus on detailing our proposed multi-scale self-attention module and differential cross-modal attention module","venue":null,"work_id":"1ace0fa7-6b72-4081-850a-bf74e78dff40","year":null},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:6c5d64cad8b89ab68f60f2dca38be5811cd3371dfb3f6f520116031b6d3f2c60","observation_id":"bab9738a-5374-4fd9-a75e-abe0a469b0c7","resolution":{"observed_at":"2026-05-17T02:31:27.800498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Datasets We evaluated our method on the public dataset FakeA VCeleb [15]","venue":null,"work_id":"8cad3683-c7c2-45e3-a09d-066dcbfc3330","year":null},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:534d8f359e94bb4854538aadd04182408d49c9c33bf117830358e8bd500aa358","observation_id":"42acbf42-53b2-49e4-8aa4-d1090a00d244","resolution":{"observed_at":"2026-05-17T02:31:27.779603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In addition, each module was analyzed in detail through ablation experiments","venue":null,"work_id":"cd0a2959-d245-40ca-80d8-fdb4eb984b9a","year":null},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:109f7ba8662383053539025443e87911b5a7210d2bfb90e5b71ce56d7f41e791","observation_id":"e75680c4-02f5-4cbe-a4f9-f33fafcf8c6b","resolution":{"observed_at":"2026-05-17T02:31:27.797424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Specifically, cross-modal differential attention enhances the model’s compatibility with multi-modal deepfake detection tasks by leveraging atten- tion matrix differences","venue":null,"work_id":"09dc9570-0a5c-45cc-a0d9-da7d254fd4d0","year":null},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:3eecd4d40c1efa331ac406edee266bf51edf82bfd9c4dc6209e81b50cb892ea9","observation_id":"2c30336d-2012-48bc-998b-a1206d7979ce","resolution":{"observed_at":"2026-05-17T02:31:27.785976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Auto-encoding variational bayes","venue":null,"work_id":"0c721296-0cdb-4fef-9d63-5df939cbe72f","year":2014},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:7e5ac5cd62c4cf5876939c292ecb0a0ea4ac997e2e60346d44c31ab2f43a26d9","observation_id":"aabb139c-2468-491e-b705-d45de3352052","resolution":{"observed_at":"2026-05-17T02:31:27.782575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative adversar- ial networks","venue":null,"work_id":"63297d05-672a-4548-9743-aca2c3427b46","year":2020},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:55ac32da15915bff2dd823ad27a7e1c5956e75dbdf9eb947ec3dd91f0aed1ab4","observation_id":"1de6df84-b19b-4a95-a9b6-5de1ff36d9f7","resolution":{"observed_at":"2026-05-17T02:31:27.812486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denois- ing diffusion probabilistic models","venue":null,"work_id":"f9d5be13-9403-45bf-ba60-c8648514d7b8","year":2020},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:8f2d26ce15da951f9c4fb8ca625ecfdff2a66c894e24141f5c7e24bf2fe370ae","observation_id":"5cf1ceed-c71e-4d76-8300-c77de76ad17b","resolution":{"observed_at":"2026-05-17T02:31:27.769183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Contin- ual unsupervised domain adaptation for audio deepfake detection","venue":null,"work_id":"fd31def0-657d-4945-9e4d-0b8e41806c9f","year":2025},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:34009c94287af49de94af74cfa784a290475bc0faff9643ffe40c108c2d6e9cb","observation_id":"2f02119b-6b33-4f79-9116-7ad8b7f623a0","resolution":{"observed_at":"2026-05-17T02:31:27.794554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tall: Thumbnail layout for deepfake video detection","venue":null,"work_id":"a93edb7a-fdd6-4a47-91a1-67185abb5901","year":2023},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:8043ab0a8e363148296a23f9bee8ffaddcf83939f1126c6746d88b215a6026eb","observation_id":"fbab5bbf-7053-4f5b-8c05-32f5adbe884e","resolution":{"observed_at":"2026-05-17T02:31:27.777230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-modality and within-modality regularization for audio-visual deepfake detection","venue":null,"work_id":"274042fc-4cd8-469b-b6e5-738e98d126be","year":2024},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:e5f04c800b2c76827ccdfff1caa5a53171cca8753147dabc6034b1971eac6992","observation_id":"5ba35488-438c-4e96-84e4-57ce3540654a","resolution":{"observed_at":"2026-05-17T02:31:27.766415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotions don’t lie: An audio-visual deepfake detection method using affec- tive cues","venue":null,"work_id":"dc7039e5-e95f-4401-8b4d-49e93df37539","year":2020},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:64f99f4ccf4375f0e3c013ab40901a5850557d7dc355e865179f420788f169aa","observation_id":"9ebad879-2b83-4fe1-a529-57683c644483","resolution":{"observed_at":"2026-05-17T02:31:27.808112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Not made for each other- audio-visual dissonance-based deepfake detection and localization","venue":null,"work_id":"5e74be83-f574-49c7-aeac-86618b78e446","year":2020},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:e717ad4f0b1ce7749bae64227df553cc7bd2d0aeaaaa41beb185de9d002a5196","observation_id":"991b2096-d18c-4ce7-b200-7e59e02b6ee9","resolution":{"observed_at":"2026-05-17T02:31:27.761800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audio-visual temporal forgery detection us- ing embedding-level fusion and multi-dimensional con- trastive loss","venue":null,"work_id":"e1b694fd-4c58-447e-b031-0f96747a9a85","year":2024},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:bca33751dfe258cad84f5a85278bd8e77626fd91e74bdec5c875cf1073634c5b","observation_id":"01e07ba6-c073-4752-a355-6694ec56d03a","resolution":{"observed_at":"2026-05-17T02:31:27.815330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is someone speak- ing?: Exploring long-term temporal features for audio- visual active speaker detection","venue":null,"work_id":"5cc7fec2-733d-4eb9-b886-4e3d0b2227a6","year":2021},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:9e32a55467871250181a1ea17c9b89f1d8bc6eb46b2a5194e35bf0fca5f2b3af","observation_id":"a7815d4f-f724-4907-894c-f8c2e6a72b37","resolution":{"observed_at":"2026-05-17T02:31:27.802983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Differential transformer","venue":null,"work_id":"79b9db02-d78d-4374-8ed7-91044457df27","year":2025},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:b919a437b47d919b4534827293f6af5806a9ddc19c6df28108da16796d2115e5","observation_id":"854eb134-783b-4a15-9cc8-a68364911d4a","resolution":{"observed_at":"2026-05-17T02:31:27.763876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V oice-face homogeneity tells deepfake","venue":null,"work_id":"ca110161-1311-4b0c-b682-dea214bfbfa9","year":2023},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:20c43a5908dcd4538b87fbb450f6bcc47e879b794d4ac68698df7827d40df46a","observation_id":"5b085bd1-5760-4d7b-88e7-d0c35832e89b","resolution":{"observed_at":"2026-05-17T02:31:27.788811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Avoid-df: Audio-visual joint learning for detecting deepfake","venue":null,"work_id":"2296f523-cc69-4dd2-a783-4622d843eada","year":2015},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:4894771a20e2582c36d09028c9ca62e041abd1413a57cbb6b751a4bd8eab65d2","observation_id":"b503a24a-b51e-4ed4-af11-46eed332e0b5","resolution":{"observed_at":"2026-05-17T02:31:27.805485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Busterx: Mllm-powered ai-generated video forgery detection and explanation","venue":null,"work_id":"647f150b-7b3e-426a-9674-18098eea5f45","year":2025},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:c10666d88f566fd5ae660e7e7140f5055ab29a76955b5ceaaa16c1b29d064dfe","observation_id":"8577dbaa-a277-470b-8e28-a2e729880e05","resolution":{"observed_at":"2026-05-17T02:31:27.759362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FakeA VCeleb: A novel audio-video mul- timodal deepfake dataset","venue":null,"work_id":"f3a12ccf-45b9-45b1-93e5-c779bf57ac68","year":2021},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:19279c3e75b88f451573160ce7e0b91c4d76469ee9468e29b1890c138fad3536","observation_id":"47c0109a-815b-42c2-83ae-dae2c8540d6c","resolution":{"observed_at":"2026-05-17T02:31:27.757024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Res2net: A new multi-scale backbone architecture","venue":null,"work_id":"5e522630-b171-48c1-aa79-180d155f8242","year":2021},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:37df11e630d933721e3c936165b47fbf4b61327d387d35d2bfec283d50adf48a","observation_id":"34322b64-f1dc-4144-ae8b-7d476e1d7d91","resolution":{"observed_at":"2026-05-17T02:31:27.771940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wavelet convolutions for large receptive fields","venue":null,"work_id":"7ebeffbe-cbc0-4391-8106-c83151e3ba0d","year":2024},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:143f70c50484e346eec6c8bee8e401c5da448f6730d75f2c993e2557e39b7db6","observation_id":"3645e9d6-7bd2-4eec-9014-51a8481e2c7d","resolution":{"observed_at":"2026-05-17T02:31:27.818107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cbam: Convolutional block attention module","venue":null,"work_id":"8f06dc83-56c5-4571-9da5-b9963cc238f4","year":2018},"citing_paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:22.711855Z"},"links":{"citing_paper":"/paper/2604.07741"},"observation_digest":"sha256:3c09ae338ed1ae24545f4b5b619049673250fd7987bd362d3b4a04124b6a5e0d","observation_id":"0fa68169-e2bd-417a-91fc-7f6eb12f57b3","resolution":{"observed_at":"2026-05-17T02:31:27.774502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.07741","last_updated":"2026-04-09T02:56:16Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:56:16Z","title":"MSCT: Differential Cross-Modal Attention for Deepfake Detection"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":1,"verified_fuzzy":23},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2604.07741."}