ElevenLabs 发布 Eleven v4 语音模型及更低延迟的 Turbo 变体
ElevenLabs 发布 Eleven v4 语音模型,更准确地遵循情感、停顿和音效等方向提示,发音基准得分从 v3 的 85.6% 升至 91.7%,支持语言从约 70 种增至 90 多种,单次请求可处理 10000 字符。
ElevenLabs 发布 Eleven v4 语音模型,更准确地遵循情感、停顿和音效等方向提示,发音基准得分从 v3 的 85.6% 升至 91.7%,支持语言从约 70 种增至 90 多种,单次请求可处理 10000 字符。
AWS 在 SageMaker AI 上通过 vLLM-Omni Deep Learning Container 部署 Qwen3-TTS,实现文本流入、音频流出的双向流式语音输出,语音可在生成完成前开始播放。
Meta 在 Connect 2026 上将个人智能体 Muse 作为硬件加智能体战略的核心:Muse 新增语音和实时视频支持、每个 Muse 拥有独立邮箱(Muse Mail)、Mac 端支持 computer use,并将登陆所有 Meta 眼镜。