AI 前沿 · 动态速递
9月30日,语音 AI 公司 ElevenLabs 发布 v4 与 v4 Turbo 两款语音模型:支持语言从 70 个增至 90+ 个,克隆一个声音所需的样本从过去的较长录音降到 10 秒音频;Turbo 版中位推理延迟约 100 毫秒,已经接近真人对话的即时感。
省事的一面:视频配音、有声书、无障碍朗读、多语种客服,成本和门槛都在快速下降。危险的一面也要直说:声音伪造的门槛同样在降——10 秒素材就可能仿出熟人声线,「我是你领导/你儿子,急用钱」这类语音诈骗会更有欺骗性。
技术是中性的,但这条新闻建议你记住一个动作:凡是涉及转账的「熟人语音」,一律挂断后用原号码回拨核实。这条习惯在 v4 时代比以往任何时候都值钱。家里有老人的,把这句话转给他们。
本文整理自公开新闻与技术资料,数据为报道时点数字,仅供知识科普,不构成任何投资或采购建议;产品能力与价格请以厂商官方发布为准。