速递|获NVIDIA支持,AI语音Gradium融资1亿美元,专注超低延迟语音AI模型
速递|获NVIDIA支持,AI语音Gradium融资1亿美元,专注超低延迟语音AI模型Gradium 是一家总部位于巴黎、提供语音 AI 模型的初创公司,其对种子轮向包括 NVIDIA 在内的新投资者重新开放后,本轮融资总额现已达 1 亿美元,该公司周四表示 。这家初创公司是从法国 AI 实验室 Kyutai 分拆出来的(该实验室由 Niel 支持)。
搜索
Gradium 是一家总部位于巴黎、提供语音 AI 模型的初创公司,其对种子轮向包括 NVIDIA 在内的新投资者重新开放后,本轮融资总额现已达 1 亿美元,该公司周四表示 。这家初创公司是从法国 AI 实验室 Kyutai 分拆出来的(该实验室由 Niel 支持)。
就在刚刚,OpenAI 正式推出了全新一代语音模型 GPT-Live。正如它的名字一样,这一次,ChatGPT 的语音功能彻底「活」了过来。据官方透露,目前每周有超过 1.5 亿人使用 ChatGPT 的语音和听写功能来练习外语、讲睡前故事或在通勤时打发时间。而从今天起,这 1.5 亿人将迎来一次豆包式的进步:
GPT-Live 基于全双工架构构建,也就是说,它可以同时听和说。在对话过程中,GPT-Live 可以用 mhmm 或 yeah 这样的回应表示自己正在听,也可以进行快速来回交流;当你需要一点时间思考时,它也会保持安静。最终带来的,是一种非常轻松自然的语音交互体验。
ElevenLabs 已与投资者就让员工在二级市场出售股份进行早期洽谈,据知情人士称,这项要约将把这家人工智能初创公司的估值定在约 220 亿美元。两位知情人士补充说,这次要约收购可能会在二月一轮融资后将公司的估值翻一番,预计将在九月之前进行。知情人士表示,这些谈判仍处于早期阶段,且可能会发生变化;他们要求在讨论私人信息时不被点名。
全球第一!中国AI语音ViiTorVoice首创「局部编辑」神技:配音错字告别重录,像改Word一样修语音。内附姆巴佩、哈兰德爆笑实测,快来见证!这个凭空出世的中国模型,将 Qwen3-TTS、CosyVoice3、Fish Audio 等一众主流巨头挑落马下,径直登顶综合排名第一!
今天发现阿里刚刚把千问输入法做成了独立客户端,上线了 Mac 版本。我第一时间下载体验了一遍。结果比我预期更有意思。安装完成后,不需要登录,免费可用。
千问输入法APP没等到,阿里云的全新AI输入法先上线了。 《读佳》获知,阿里云推出全新的AI语音输入法“CosyVoice”,这是一款以语音输入为主的智能语音输入法,支持多语种实时转写、方言识别、指令
火山引擎今天上线了全新的语音模型—— 豆包音频生成模型 1.0(Seed-Audio 1.0)。
把 VoiceVault 的转录引擎从 Whisper 迁移到 FunASR(sherpa-onnx),中文识别速度提升 3x,不再需要 500MB 的模型文件。但"切个后端"这件听起来很简单的事,让我在 GitHub Release 的 404、Tauri 白屏、trait object 生命周期和 CSP 策略里翻滚了一整天。
当所有人都在盯着通用大模型时,Voice AI 这条相对安静的赛道里,也开始出现一些值得注意的新模型。最近,一家名为 Hojo 的创业团队公开披露了一组语音识别测试结果,似乎有成为「黑马」的趋势。