9月29日讯,据unite.ai 报道,elevenlabs正式发布全新文本转语音模型eleven v4,官方宣称这是其迄今为止表现力最强的tts模型;同时推出专为实时交互场景优化的低延迟版本——eleven v4 turbo。目前两款模型已全面上线elevenagents、elevencreative及elevenapi平台,所有用户均可通过免费账户直接调用。
Eleven v4采用全新底层架构,能够精准识别并还原文本中的语气变化、语速节奏、情感倾向、角色设定及上下文语境;新增说话人身份建模技术,显著提升音色稳定性与一致性;引入场景级上下文理解能力,使多轮对话更富自然感与连贯性。用户可通过自然语言指令及内联音频标记(Inline Audio Tags)灵活调控语音演绎效果,而SSML标签在v4中已被正式弃用。两款模型均支持超90种语言,即时语音克隆功能仅需10秒原始音频即可完成高保真声纹提取,且所有克隆操作均须经声音所有权人授权验证。
根据官方披露,Eleven v4在2026年9月Artificial Analysis Provider Voice Arena权威评测中荣登榜首。定价体系延续现有积分制,免费用户每月可享1万积分额度。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜


















