AI擬聲

AI擬聲

AI擬聲是基於人工智慧技術生成仿真語音的合成技術,通過採集目標聲音樣本實現文本到語音的轉換。該技術可被不法分子利用,通過騷擾電話錄音提取聲紋數據合成虛假語音,用於電信詐欺等違法犯罪活動。現有開源模型如Tacotron 2、FastSpeech 2和VITS支持高質量語音合成,其中VITS結合變分自編碼器和對抗生成網路,在語音自然度和相似度上表現優異。

倫敦瑪麗女王大學研究團隊指出,AI生成的“克隆語音”逼真度與真人錄音無異。2019年首次出現利用深度偽造語音冒充企業高管實施跨境詐欺的案例,涉案金額達24萬美元。2023年內蒙古包頭警方通報利用AI擬聲技術冒充熟人實施電信詐欺的案例,涉案金額達430萬元。2025年3月,雷軍針對技術濫用引發的肖像權侵犯、個人信息泄露及詐欺風險,提出加快單行法立法進程和強化平台責任約束機制的建議。2025年10月發生的弒母分屍案中,犯罪嫌疑人通過復刻死者聲紋偽造存活假象,成功誤導警方與家屬十天。

國際社會已開展深度偽造語音檢測技術研發,自2015年起陸續推出多語言語音檢測挑戰賽,2024年擴展至包含會話語音的多模態數據集。國家金融監管機構將該技術列為新型電信詐欺典型類型,提示公眾防範風險。影目科技發布的INMO GO3智慧型眼鏡套用該技術實現雙向對話實時翻譯,可通過用戶語音模擬播放對方語言。

基本介紹

  • 中文名:AI擬聲
  • 類型:AI合成技術
技術介紹,社會危害,治理與建議,

技術介紹

AI擬聲指利用AI技術將文本或其他形式的信息轉換為語音輸出。AI合成語音技術能夠高度模擬真實語音的聲調、語速和情感特徵,使其輸出與真人錄音難以區分。不法分子通過騷擾電話錄音等來提取某人聲音,獲取素材後再進行聲音合成,從而可以用偽造的聲音騙取目標人群。
AI擬聲

社會危害

2025年3月,關於加強“AI換臉擬聲”違法侵權重災區治理,雷軍提到,人工智慧(AI)深度合成技術的快速發展,推動了“AI換臉擬聲”在影視、廣告、社交等領域廣泛興起,成為社會喜聞樂見、傳播力強、易成熱點的技術套用。但同時,“AI換臉擬聲”不當濫用造成了違法侵權行為的重災區,易引發侵犯肖像權、侵犯公民個人信息以及詐欺等犯罪行為,帶來社會治理等風險。基於此,他提出加快單行法立法進程、壓實平台企業等各方的責任和義務等建議。
此外,2025年12月,《中國新聞出版廣電報》刊文指出,AI克隆聲音技術在短視頻平台上流行,仿冒視頻克隆明星、學者等公眾人物聲音,散播真假難辨的內容。聲音淪為可買賣、篡改的數字元號,解除與人類主體的天然綁定。聽覺的沉浸性使AI偽造聲音更隱秘,易讓人在生理層面誤以為“他就在那兒”並放下警惕。儘管《中華人民共和國民法典》第一千零二十三條第二款規定聲音保護參照肖像權,但技術賦權下取證難、認定難,法律執行面臨挑戰。濫用行為不僅傷害歌手、配音從業者等公眾人物,還誘導消費、投資欺詐等違法行為,對社會信任造成深層危害。

治理與建議

治理AI克隆聲音亂象,監管須走在技術之前,而非被動滯後“補漏”。未來,持續完善符合人工智慧發展需求的治理體系、提升相關治理能力,保持政策靈活性。
各類平台理當承擔主體責任,建好“技術護欄”,讓聲音克隆可查、可控、可追溯。內容傳播平台要把好“入口”,提供買賣服務的平台也應對克隆行為嚴格管理。
只有發布者自律、平台盡責、監管到位,形成治理合力,才能讓技術在制度的邊界內平穩運行。但更重要的是廣泛公眾意識的提升:認識到聲音是人的延伸、情感的觸角,而非市場的玩物。

相關詞條

熱門詞條

聯絡我們