AI擬聲是基於人工智慧技術生成仿真語音的合成技術,通過採集目標聲音樣本實現文本到語音的轉換。該技術可被不法分子利用,通過騷擾電話錄音提取聲紋數據合成虛假語音,用於電信詐欺等違法犯罪活動。現有開源模型如Tacotron 2、FastSpeech 2和VITS支持高質量語音合成,其中VITS結合變分自編碼器和對抗生成網路,在語音自然度和相似度上表現優異。
倫敦瑪麗女王大學研究團隊指出,AI生成的“克隆語音”逼真度與真人錄音無異。2019年首次出現利用深度偽造語音冒充企業高管實施跨境詐欺的案例,涉案金額達24萬美元。2023年內蒙古包頭警方通報利用AI擬聲技術冒充熟人實施電信詐欺的案例,涉案金額達430萬元。2025年3月,雷軍針對技術濫用引發的肖像權侵犯、個人信息泄露及詐欺風險,提出加快單行法立法進程和強化平台責任約束機制的建議。2025年10月發生的弒母分屍案中,犯罪嫌疑人通過復刻死者聲紋偽造存活假象,成功誤導警方與家屬十天。
國際社會已開展深度偽造語音檢測技術研發,自2015年起陸續推出多語言語音檢測挑戰賽,2024年擴展至包含會話語音的多模態數據集。國家金融監管機構將該技術列為新型電信詐欺典型類型,提示公眾防範風險。影目科技發布的INMO GO3智慧型眼鏡套用該技術實現雙向對話實時翻譯,可通過用戶語音模擬播放對方語言。
基本介紹
- 中文名:AI擬聲
- 類型:AI合成技術




