{"as_of":"2026-08-09T06:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db965529cc74b0eaf14aca54e993ca17a6997d8c366581cecf8a001667507955","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:37:29.997581Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T10:28:22.453820Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09175","snapshot_observed_at":"2026-07-31T10:28:22.453820Z","title":"Molex: Mixture of lora experts in speech self-supervised models for audio deepfake detection.arXiv preprint arXiv:2509.09175,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28351","last_updated":"2026-07-30T15:21:38Z","snapshot_observed_at":"2026-08-08T20:24:07.187604Z","submitted_at":"2026-07-30T15:21:38Z","title":"Teffic-Audio: Tell Fact from Fiction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T10:28:22.453820Z"},"links":{"cited_paper":"/paper/2509.09175","citing_paper":"/paper/2607.28351"},"observation_digest":"sha256:6f00fdd36b6314613b02f04fc3238b2144c0ea4efe24ac14552b1626f0ee4c45","observation_id":"36d40298-5761-4e16-a2be-ed767dca83ea","resolution":{"observed_at":"2026-07-31T10:28:22.453820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.09175/citation-record","integrity":"/paper/2509.09175/integrity","json":"/paper/2509.09175/citation-record.json","paper":"/paper/2509.09175"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:26.445106Z","title":"Asvspoof 5: crowdsourced speech data, deepfakes, and adversarial attacks at scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.445106Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:943944a2deee4805e0e01ba06ef2cb33ecc97973fe65c964dbbc6145c3b301b5","observation_id":"9e61517d-83b6-4862-8bba-dccecbbcc6d9","resolution":{"observed_at":"2026-08-04T19:37:26.445106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10117","last_updated":"2024-12-25T11:54:03Z","snapshot_observed_at":"2026-08-09T04:36:59.879757Z","submitted_at":"2024-12-13T12:59:39Z","title":"CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10117","snapshot_observed_at":"2026-08-04T19:37:26.488189Z","title":"Cosyvoice 2: Scalable streaming speech synthesis with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.488189Z"},"links":{"cited_paper":"/paper/2412.10117","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:8b6a640b04947e1177df4c765de8dc58ea4954982e11b73d91ad1d94e60022e1","observation_id":"d8ae4f8c-4df6-4b5d-8834-a4d75741dc7b","resolution":{"observed_at":"2026-08-04T19:37:26.488189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:26.558517Z","title":"Aasist3: Kan-enhanced aasist speech deepfake detection using ssl features and additional regularization for the asvspoof 2024 challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.558517Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:0858e799698443bbe26ff4eec9c32c3113eda38d0417ac84c3e2dda683167f40","observation_id":"50776e04-6bb1-4881-bbc5-32fb62cf93c9","resolution":{"observed_at":"2026-08-04T19:37:26.558517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:26.629639Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.629639Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:21abcaebdd6bddc97a4299531dcf25b7f3f64bbc0a7ce09311eae9b969fafc6f","observation_id":"22c6a242-7c07-4fb9-aa82-29d5edf093da","resolution":{"observed_at":"2026-08-04T19:37:26.629639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:26.689621Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.689621Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:5c06a19ce0118cb657beafc27fd1da1b4b9275b6f3bc907b5fca1afd1f34fe9d","observation_id":"6b5d2fbe-6db3-41f8-a01b-8151965077e2","resolution":{"observed_at":"2026-08-04T19:37:26.689621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:26.752799Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.752799Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:9091c6dfe398508b060d131ca1cae6c05859ec27a269efe1627e621bf7cb0690","observation_id":"42a860d6-b608-42f0-b262-19c3d866853f","resolution":{"observed_at":"2026-08-04T19:37:26.752799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:26.811824Z","title":"Learn from real: reality defender’s submission to asvspoof5 challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.811824Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:47eebdec2ce1caeb0a36a500290ebb1171448f8b2646b53a45df2b3e970c83e9","observation_id":"498a1191-8534-48ee-bb4a-d989f45d3531","resolution":{"observed_at":"2026-08-04T19:37:26.811824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:26.851820Z","title":"Peft-ser: On the use of parameter efficient transfer learning approaches for speech emotion recognition using pre- trained speech models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.851820Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:aea2e91fa4982d22d05bfb36c8f7b5e8b9b0e19e1ed8cfb13857754603068873","observation_id":"16a2d937-2780-4802-a986-d9b1409744b1","resolution":{"observed_at":"2026-08-04T19:37:26.851820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02122","last_updated":"2024-02-07T07:36:34Z","snapshot_observed_at":"2026-07-06T17:11:30.048581Z","submitted_at":"2024-01-04T08:11:33Z","title":"PEFT for Speech: Unveiling Optimal Placement, Merging Strategies, and Ensemble Techniques","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02122","snapshot_observed_at":"2026-08-04T19:37:26.915596Z","title":"Peft for speech: Unveiling optimal placement, merging strategies, and ensemble techniques,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.915596Z"},"links":{"cited_paper":"/paper/2401.02122","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:29551bed38756eeb0a099baef2a17cbecdf827c36db86cfbe694facb27e1ee2b","observation_id":"442220de-eaa2-4d6b-8fdd-ea0834ad28fa","resolution":{"observed_at":"2026-08-04T19:37:26.915596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-04T19:37:26.986670Z","title":"Adalora: Adaptive budget allocation for parameter-efficient fine-tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:26.986670Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:6056e10f73e97d91a8079866d6f05eb6bce7ab7e85bd0159806314f1e9f107dc","observation_id":"f5af7429-8913-4402-a9ae-f1ebad3f3921","resolution":{"observed_at":"2026-08-04T19:37:26.986670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.049152Z","title":"X-lora: Mixture of low-rank adapter experts, a flexible framework for large language models with appli- cations in protein mechanics and molecular design,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.049152Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:fecb6392b58d1ffb6123b759fcb4ab189ae3149875a6b020de2ba2f2eb86e2b9","observation_id":"ecfff722-331f-4df5-ae13-4058782cb55b","resolution":{"observed_at":"2026-08-04T19:37:27.049152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-04T19:37:27.112089Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.112089Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:d0ad61d4085dfec392f4983db0f4c0f3f7d1213a77d98ddc72961d909fc2ae8b","observation_id":"bcd6788c-2d94-4fce-9215-357c3e2411bb","resolution":{"observed_at":"2026-08-04T19:37:27.112089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-04T19:37:27.164902Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.164902Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:7a8ad0c033e4847c56a16034c6de98a899dd83528292712c6f40a5a707bdd1cf","observation_id":"d1c2eb36-9da2-4eb5-b15a-26c536277600","resolution":{"observed_at":"2026-08-04T19:37:27.164902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04153","last_updated":"2024-07-04T20:59:20Z","snapshot_observed_at":"2026-08-06T03:49:14.814294Z","submitted_at":"2024-07-04T20:59:20Z","title":"Mixture of A Million Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04153","snapshot_observed_at":"2026-08-04T19:37:27.224525Z","title":"Mixture of a million experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.224525Z"},"links":{"cited_paper":"/paper/2407.04153","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:96ccf24421ae753841bf933df19fa9277aeb39dc89bd95b09c0b4be83ee9ad3e","observation_id":"b4016bff-8614-4827-8e25-b67cda9bb738","resolution":{"observed_at":"2026-08-04T19:37:27.224525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.286758Z","title":"Improving speech emotion recognition by fusing self-supervised learning and spectral features via mixture of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.286758Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:d95eb238aaa13752f213b38d595adac7a0a930d661b8a2c3df96aaad88a9956b","observation_id":"6e1e16d4-1592-44df-822a-1ad66aaaef8e","resolution":{"observed_at":"2026-08-04T19:37:27.286758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12410","last_updated":"2022-11-02T02:47:17Z","snapshot_observed_at":"2026-08-07T19:57:36.466885Z","submitted_at":"2022-05-24T23:41:22Z","title":"AdaMix: Mixture-of-Adaptations for Parameter-efficient Model Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12410","snapshot_observed_at":"2026-08-04T19:37:27.317674Z","title":"Adamix: Mixture-of-adapter for parameter-efficient tuning of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.317674Z"},"links":{"cited_paper":"/paper/2205.12410","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:1a05744aa3b4915269ec522700da515791cb54e2478fb8f739fff33e6c64275a","observation_id":"0645af8c-2bc8-4eb0-981d-ed3fef437a2e","resolution":{"observed_at":"2026-08-04T19:37:27.317674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.373238Z","title":"Adaptermix: Exploring the efficacy of mixture of adapters for low-resource tts adaptation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.373238Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:e1ffefcf20d7f15b13f45c4083ff8991c68d7e087bca339621343ce17095af62","observation_id":"c98fe56a-7c31-48d7-942c-1bb2771b9382","resolution":{"observed_at":"2026-08-04T19:37:27.373238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.406210Z","title":"Moe-ffd: Mixture of experts for generalized and parameter-efficient face forgery detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.406210Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:747a5775eb8d77551c36231c9d5a5075fa68af9b443e13741ff52d5a532b13dd","observation_id":"a80f0cdd-6755-46e7-945e-cc720d132eb2","resolution":{"observed_at":"2026-08-04T19:37:27.406210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.462244Z","title":"Mixture of lora experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.462244Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:6a0028e0c94b3d7dba29aff3763b2e2f01266d3912d0b295d33b74d2bb43782d","observation_id":"3387b20a-329e-46bd-94c8-e744a022718d","resolution":{"observed_at":"2026-08-04T19:37:27.462244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.521356Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.521356Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:17c947dc562e1f3a18976827a18bd56a70300981af224a2084fad261eeb56423","observation_id":"e71a7a06-99c8-47c6-bc1e-ab5032375729","resolution":{"observed_at":"2026-08-04T19:37:27.521356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.554581Z","title":"Attentive merging of hidden embeddings from pre-trained speech model for anti-spoofing detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.554581Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:a7f8cc0dd6f71720975e33060408e6a4657ac9b5eb5202684a53da8de2b8a119","observation_id":"dccbc5ce-3281-4247-a735-0a3280c2ef20","resolution":{"observed_at":"2026-08-04T19:37:27.554581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-04T19:37:27.614417Z","title":"Scaling language models: Methods, analysis & insights from training gopher,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.614417Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:3bb56a92ca6dbfb6059916dde3cbe504528b636c854528f001524c97628590b7","observation_id":"ffcc0233-1023-46f1-ab9f-0171f3987d29","resolution":{"observed_at":"2026-08-04T19:37:27.614417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.668639Z","title":"A survey on lora networking: Research problems, current solutions, and open issues,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.668639Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:5a35aeddbf1615e02ae6aafce3b9ee9610eb993c9cb66181158ecdca0bef1698","observation_id":"358c3471-c0d9-40c8-85b2-ec2687cc0572","resolution":{"observed_at":"2026-08-04T19:37:27.668639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.729147Z","title":"Mixture-of-experts with expert choice routing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.729147Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:45e04f9dee16cc44041a9842c6e7045dc786c964c190df7ea5efc2823f891cf0","observation_id":"aa3d488f-19f2-42d3-8d71-84593692de37","resolution":{"observed_at":"2026-08-04T19:37:27.729147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.788650Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.788650Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:b5c9db47925973b53cf2ae25046578a390c406ac66d9d594465a8f810f4adcf7","observation_id":"e52f48aa-afc8-4fba-8f60-a8e6c41a453f","resolution":{"observed_at":"2026-08-04T19:37:27.788650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.817223Z","title":"Speech foundation model ensembles for the controlled singing voice deepfake detection (ctrsvdd) challenge 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.817223Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:3cc55e16ec540b74cf51d5885f265907126c0b8713b83e4c678b3957a7ee2812","observation_id":"eaad7d50-c8c8-423c-a681-d2f274001293","resolution":{"observed_at":"2026-08-04T19:37:27.817223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17513","last_updated":"2024-03-18T02:13:24Z","snapshot_observed_at":"2026-07-06T16:39:04.459332Z","submitted_at":"2023-10-26T16:08:33Z","title":"The Expressive Power of Low-Rank Adaptation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17513","snapshot_observed_at":"2026-08-04T19:37:27.874964Z","title":"The expressive power of low-rank adaptation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.874964Z"},"links":{"cited_paper":"/paper/2310.17513","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:fa895b00c257777992d598d418bf13ac63e369d8e0d6baf722be54ce4b6bddaf","observation_id":"a719c4e9-1ca6-4f82-b0f5-674aa98375f6","resolution":{"observed_at":"2026-08-04T19:37:27.874964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.934157Z","title":"ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.934157Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:72662a9cad82c04d7493fd1dc861f8e9ccd625b08053362adcaf4718be8e9cfa","observation_id":"35f7b1bd-e857-4848-b271-a4503828b550","resolution":{"observed_at":"2026-08-04T19:37:27.934157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:27.963405Z","title":"The Singular Value Decomposition (SVD) and Low-Rank Matrix Approximations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.963405Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:5c75b707fdcf4219fff19915fd086a1e6f6c70d69431d4db8e4def8d631c78b3","observation_id":"848c1aaf-d54a-4383-9768-2fc677161c19","resolution":{"observed_at":"2026-08-04T19:37:27.963405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.049871Z","title":"A single end-to-end voice anti-spoofing model with graph attention and feature aggregation for asvspoof 5 challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.049871Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:73f8eb6c3e0796a898e53daee088ec7cde2ce839048e13770c9e68078fde466b","observation_id":"cb014dbe-4d5c-4238-9b0c-a9593d95dfef","resolution":{"observed_at":"2026-08-04T19:37:28.049871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.081373Z","title":"A study of guided masking data augmentation for deepfake speech detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.081373Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:6ecb8517f91be635eec329793c1006cfdce313d9eeb797297d3b71af1a61c85c","observation_id":"a56a2e1e-edf2-4d8f-9681-6552597b9b28","resolution":{"observed_at":"2026-08-04T19:37:28.081373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.134227Z","title":"Enhancing spoofing detection in asvspoof 5 workshop 2024: fusion of wavlm-resnet18-sa for optimal performance against speech deepfakes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.134227Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:1220b52736ae16e96843add53a7829673029d93f8c119c177059a0f463cb5a64","observation_id":"8d5f0672-958c-4602-a79d-41cfef8d30d7","resolution":{"observed_at":"2026-08-04T19:37:28.134227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.163760Z","title":"Exploring wavlm back- ends for speech spoofing and deepfake detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.163760Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:dd42383ea4441306d4e9198c85b2823199eca96f7632afd9521d20cc840e2259","observation_id":"76fc21ef-2d16-4cdf-9d43-a95ebe74b6d3","resolution":{"observed_at":"2026-08-04T19:37:28.163760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.217084Z","title":"Wavlm model ensemble for audio deepfake detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.217084Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:a4aedbcc09425988e55a3202b54fefa45c795247110461a958c43752489234be","observation_id":"b536bf72-91c5-4ba2-b61c-f95340407f66","resolution":{"observed_at":"2026-08-04T19:37:28.217084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.246187Z","title":"Asvspoof 2019: A large-scale public database of synthesized, converted and replayed speech,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.246187Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:c89d0bd636c83b0b11d99b870bdfc434e6bb035f7879937a3dd2915eed535a4a","observation_id":"b3f4e066-afc5-47d7-809d-5dd91d53825f","resolution":{"observed_at":"2026-08-04T19:37:28.246187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.307795Z","title":"Asvspoof 2021: Towards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.307795Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:6db799fe7fbaf5334a4ff43c517fdf68b7ce540055c17ebc2c40d34370e04ea7","observation_id":"a3d99d15-ceae-4833-894c-0d751bda2fc7","resolution":{"observed_at":"2026-08-04T19:37:28.307795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.390868Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.390868Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:f131e0e2c3c12c686e4068c891d2aa6bd5763a03cc4272f949144b485ac6cf3e","observation_id":"888ed3db-8aef-4776-8ec4-eb1ce59ed668","resolution":{"observed_at":"2026-08-04T19:37:28.390868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.417083Z","title":"Robust audio deepfake detection: Exploring front-/back-end combinations and data augmentation strate- gies for the asvspoof5 challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.417083Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:ad27eabbed8f0f7b870bfc006bf75cbd1ddff0aed55d6039ff49d45e993351cb","observation_id":"595c4713-c689-4669-bad1-cf3adb20ce88","resolution":{"observed_at":"2026-08-04T19:37:28.417083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.472799Z","title":"Ai-synthesized voice detection using neural vocoder artifacts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.472799Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:3233bacced43ff9023fdf8dce67fb429632642b0999d044bdc36b77aa17c28b1","observation_id":"b7cc17db-b246-40e7-aa47-7b2ee83bb467","resolution":{"observed_at":"2026-08-04T19:37:28.472799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.528723Z","title":"Dfadd: The diffusion and flow-matching based audio deepfake dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.528723Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:7031939aab837fc7d98efcad66de465ef26711559fb66ddcb3452c52e47152df","observation_id":"93e0feb2-0bf0-4d88-8399-c66f5bad3fab","resolution":{"observed_at":"2026-08-04T19:37:28.528723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.588288Z","title":"The Fake-or-Real Dataset,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.588288Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:08e7242e41ebcbdb4245a0f7f970eb6b669f52f9659c6562c5e21a8cf8b3146c","observation_id":"eb95a7c6-7a37-416a-b0bf-887b682defa2","resolution":{"observed_at":"2026-08-04T19:37:28.588288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.648220Z","title":"Speech arena: Speech deepfake leaderboard,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.648220Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:e0747b697d7968eaee4ab177b5b9ea233d3889d48ba835d763b0b78c3b8cac6f","observation_id":"7bcb1ea6-5443-4c86-89e1-a2595681ac02","resolution":{"observed_at":"2026-08-04T19:37:28.648220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.704232Z","title":"Cstr vctk corpus: English multi-speaker corpus for cstr voice cloning toolkit,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.704232Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:33f87814790357d71b5b958c8c2414d980fdd8f99e61c970a366cf6041f37109","observation_id":"39bad17e-1cd5-435f-a93e-ee7a54f76ed9","resolution":{"observed_at":"2026-08-04T19:37:28.704232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-04T19:37:28.759964Z","title":"Wavenet: A generative model for raw audio,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.759964Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:cdd990ddd305e2e294d56119fef0109b1ba737b00c019facda21858275cf0fa2","observation_id":"8b22a565-f130-470e-98f4-93fce908a1f5","resolution":{"observed_at":"2026-08-04T19:37:28.759964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.819383Z","title":"Natural tts synthesis by conditioning wavenet on mel spectrogram predictions,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.819383Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:9b4a150162e88b780560ebc2f6fabd57224b62aea1805f5bb3118283342b9a8a","observation_id":"8d589217-0c50-48e4-8824-724d316dc43f","resolution":{"observed_at":"2026-08-04T19:37:28.819383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:28.906835Z","title":"Mls: A large-scale multilingual dataset for speech research,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.906835Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:5e5768a6a8529f8d8216b975630585d3424771684e09a7b2e42b0bf62a02cfe9","observation_id":"6403b49e-59dd-4c25-aae1-ec90309f2b20","resolution":{"observed_at":"2026-08-04T19:37:28.906835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-07T17:24:03.888611Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-04T19:37:28.960970Z","title":"Diffusion-based voice conversion with fast maximum likelihood sam- pling scheme,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.960970Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:4134e8ae06f206a68bf75ce8ac81e5b5b0938b4f55e5f2882bb72a4477e8cdc7","observation_id":"53fff485-e278-4622-b773-7695c7021ff4","resolution":{"observed_at":"2026-08-04T19:37:28.960970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.12223","last_updated":"2022-10-21T20:03:37Z","snapshot_observed_at":"2026-07-06T14:08:53.562621Z","submitted_at":"2022-10-21T20:03:37Z","title":"Low-Resource Multilingual and Zero-Shot Multispeaker TTS","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.12223","snapshot_observed_at":"2026-08-04T19:37:29.050838Z","title":"Low-resource multilingual and zero-shot multispeaker tts,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.050838Z"},"links":{"cited_paper":"/paper/2210.12223","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:8f47f785d9485b4bedaf231efcc4030fc7ca92799f49a9766f93281160c7227a","observation_id":"8bec96b2-18d6-4151-86bd-7ba647480784","resolution":{"observed_at":"2026-08-04T19:37:29.050838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:29.132724Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.132724Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:8da53e2303a139f35851922ba56a5e81dd63c2c4398e4914a60a14a8a2354b29","observation_id":"a3d4efd4-e109-4887-a478-5a4012b86cd4","resolution":{"observed_at":"2026-08-04T19:37:29.132724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:29.217370Z","title":"Glow-tts: A generative flow for text-to-speech via monotonic alignment search,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.217370Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:d9d4481cf9d306ac4c636bb5da745df6fcf11e9872267bb70c81d899d10ada25","observation_id":"340fe693-35d8-4fd5-95d7-040645ff8ec4","resolution":{"observed_at":"2026-08-04T19:37:29.217370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.04787","last_updated":"2018-05-11T09:23:11Z","snapshot_observed_at":"2026-07-06T06:14:09.625463Z","submitted_at":"2017-12-13T14:29:09Z","title":"Creating New Language and Voice Components for the Updated MaryTTS Text-to-Speech Synthesis Platform","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.04787","snapshot_observed_at":"2026-08-04T19:37:29.300199Z","title":"Creating new language and voice compo- nents for the updated marytts text-to-speech synthesis platform,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.300199Z"},"links":{"cited_paper":"/paper/1712.04787","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:c011cbdbdadf290c2056bf5804541720869ae23f9a4e71fee005c76bd240c88a","observation_id":"2cbd3c2b-93a2-4968-ac0c-9ce15b9976f0","resolution":{"observed_at":"2026-08-04T19:37:29.300199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:29.382603Z","title":"P-flow: A fast and data-efficient zero-shot tts through speech prompting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.382603Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:d551200650933781fa07d4f441ce727a8000e2b5b9812f2292c1d10c3297ac34","observation_id":"75a2e6e7-66ba-4d1c-8379-6f8fab5fca2e","resolution":{"observed_at":"2026-08-04T19:37:29.382603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:29.465327Z","title":"Matcha-tts: A fast tts architecture with conditional flow matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.465327Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:dd8c09b5472651afc87f4d190dcf4193c4dde899855c51ef63d1ebebc3c681f6","observation_id":"22f6a433-e921-48fa-aaf5-161bf922802c","resolution":{"observed_at":"2026-08-04T19:37:29.465327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:29.518622Z","title":"Styletts 2: Towards human-level text-to-speech through style diffusion and adversarial training with large speech language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.518622Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:3499197e64c7f64bfa5f8424701b979f88f79bbb43294e15ff7a181f976421b8","observation_id":"c99e8299-53ef-4080-a2c8-b90d6bc3b6e6","resolution":{"observed_at":"2026-08-04T19:37:29.518622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:29.576890Z","title":"Grad- tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.576890Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:c912d38021f27ba5e04094fdee1829a51876802633a2af23955f43218e1e37bb","observation_id":"67759627-10f1-4b28-876c-4066934de0a3","resolution":{"observed_at":"2026-08-04T19:37:29.576890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-07T13:32:24.356336Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-04T19:37:29.663715Z","title":"Libritts: A corpus derived from librispeech for text-to-speech,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.663715Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:a8a19d26293ba8b03b7c0b20a8251503ea093145df06f9ca47efbc3519f564ab","observation_id":"60d08358-92fd-4fcf-ae04-9d1b4c507705","resolution":{"observed_at":"2026-08-04T19:37:29.663715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:29.719531Z","title":"Parallel wavegan: A fast waveform generation model based on generative adversarial networks with multi-resolution spectrogram,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.719531Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:e5792ee19a8613caf8049b3ddba9d21274d079d340a012cb64f275b8aa6e53a7","observation_id":"f9f1113f-9f64-49be-b291-99101b1afe32","resolution":{"observed_at":"2026-08-04T19:37:29.719531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09761","last_updated":"2021-03-30T19:48:38Z","snapshot_observed_at":"2026-07-06T09:57:19.117228Z","submitted_at":"2020-09-21T11:20:38Z","title":"DiffWave: A Versatile Diffusion Model for Audio Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09761","snapshot_observed_at":"2026-08-04T19:37:29.774849Z","title":"Dif- fwave: A versatile diffusion model for audio synthesis,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.774849Z"},"links":{"cited_paper":"/paper/2009.09761","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:2c1421b090ccc7eed078334199750307e5d88f9407211a284a86f4bd5a1d7d94","observation_id":"4416c69e-7cc9-4c9e-8ecd-6d28d99763cf","resolution":{"observed_at":"2026-08-04T19:37:29.774849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.00713","last_updated":"2020-10-09T15:21:58Z","snapshot_observed_at":"2026-08-08T00:55:05.346719Z","submitted_at":"2020-09-02T17:44:10Z","title":"WaveGrad: Estimating Gradients for Waveform Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.00713","snapshot_observed_at":"2026-08-04T19:37:29.831388Z","title":"Wavegrad: Estimating gradients for waveform generation,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.831388Z"},"links":{"cited_paper":"/paper/2009.00713","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:baa57d87c45ca031d90c7d38839e5706a0df07f7610fc4bf25df945ea044c4cf","observation_id":"7f2bda4b-27ae-465c-9966-e83eb48d9040","resolution":{"observed_at":"2026-08-04T19:37:29.831388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:29.889332Z","title":"V oxForge speech dataset,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.889332Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:9c6487d6388ea9e54c1b92142d05bcd3fa572ebbc2064bcd42274ffe4515a27e","observation_id":"ae9621c4-edce-4bfe-9f05-4fce2a993088","resolution":{"observed_at":"2026-08-04T19:37:29.889332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.07654","last_updated":"2018-02-22T06:23:45Z","snapshot_observed_at":"2026-08-08T13:23:31.201685Z","submitted_at":"2017-10-20T18:17:23Z","title":"Deep Voice 3: Scaling Text-to-Speech with Convolutional Sequence Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.07654","snapshot_observed_at":"2026-08-04T19:37:29.943528Z","title":"Deep voice 3: Scaling text-to-speech with convolutional sequence learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.943528Z"},"links":{"cited_paper":"/paper/1710.07654","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:f3a2ae89cd78cc8096b019fd8ae8f9b6f2f71b4c6a4b43780d1e0d0a903d927d","observation_id":"e987ff1d-ba53-4efc-8452-832fe9358039","resolution":{"observed_at":"2026-08-04T19:37:29.943528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:29.997581Z","title":"Catastrophic forgetting, rehearsal and pseudorehearsal,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:29.997581Z"},"links":{"citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:16e5cc12052da632eefa11891ad151bb4b71e691f5d588a530ccda199db1fc9b","observation_id":"38e4db1f-b9d7-45db-8ca6-d5eb7f6e4e9f","resolution":{"observed_at":"2026-08-04T19:37:29.997581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T15:48:58.256012Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2509.09175."}