语音 AI 公司 ElevenLabs 估值翻倍至 220 亿美元
语音 AI 公司 ElevenLabs 宣布允许员工按 220 亿美元估值出售部分已归属股权,较其 2 月融资时的 110 亿美元估值翻倍。此次 3 亿美元要约收购由 Wellington 和 T. Rowe Price 联合领投,是 ElevenLabs 第二次为员工安排二级交易,此前曾在 2025 年 9 月按 66 亿美元估值完成 1 亿美元要约。
语音 AI 公司 ElevenLabs 宣布允许员工按 220 亿美元估值出售部分已归属股权,较其 2 月融资时的 110 亿美元估值翻倍。此次 3 亿美元要约收购由 Wellington 和 T. Rowe Price 联合领投,是 ElevenLabs 第二次为员工安排二级交易,此前曾在 2025 年 9 月按 66 亿美元估值完成 1 亿美元要约。
Tavus 推出 Griffin,公司称其为首个 Human Interaction Model(HIM),可在接收和生成视频的同时处理语音、面部表情、语气、手势与停顿。
Hugging Face 推出 Open TTS Leaderboard,用客观指标评测开源 TTS 模型,让单模型评测耗时从数周投票缩短到数小时。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 基础上把近实时视频生成与语音对话原生结合,让企业智能体具备会听、会看、会说的动态视觉形象,即日起在 Gemini Enterprise 上线。
推荐理由:原文给出了实时视频形象与语音对话的原生耦合方式,读者可据此判断企业级实时多模态交互的落地形态。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与逐行表演指导,后者面向高并发、低成本的配音与语音智能体场景。
推荐理由:原文给出两款 TTS 模型的能力差异、基准排名和开放入口,读者可据此判断语音生成在创作与规模化场景中的分工。
Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音对话模型,分别面向规模化低成本场景和高复杂度多步推理任务。
推荐理由:官方给出语音对话模型的两档定位与多语言、后台调用工具等能力细节,可供开发者判断接入场景。
Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与 AI 解决方案在沙特及中东地区的部署,合作规模达数亿欧元。双方将聚焦网络安全与语音领域,并开发阿拉伯语表现强劲的前沿模型;Mistral 还将探索使用 HUMAIN 的数据中心基础设施,双方计划在沙特面向受监管行业推出联合市场策略。