AI资讯新闻榜单内容搜索-AI语音

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AI语音
速递|获NVIDIA支持,AI语音Gradium融资1亿美元,专注超低延迟语音AI模型

速递|获NVIDIA支持,AI语音Gradium融资1亿美元,专注超低延迟语音AI模型

速递|获NVIDIA支持,AI语音Gradium融资1亿美元,专注超低延迟语音AI模型

Gradium 是一家总部位于巴黎、提供语音 AI 模型的初创公司,其对种子轮向包括 NVIDIA 在内的新投资者重新开放后,本轮融资总额现已达 1 亿美元,该公司周四表示 。这家初创公司是从法国 AI 实验室 Kyutai 分拆出来的(该实验室由 Niel 支持)。

来自主题: AI资讯
8934 点击    2026-07-10 14:01
刚刚,ChatGPT 语音大升级,奥特曼:既神奇也真实

刚刚,ChatGPT 语音大升级,奥特曼:既神奇也真实

刚刚,ChatGPT 语音大升级,奥特曼:既神奇也真实

就在刚刚,OpenAI 正式推出了全新一代语音模型 GPT-Live。正如它的名字一样,这一次,ChatGPT 的语音功能彻底「活」了过来。据官方透露,目前每周有超过 1.5 亿人使用 ChatGPT 的语音和听写功能来练习外语、讲睡前故事或在通勤时打发时间。而从今天起,这 1.5 亿人将迎来一次豆包式的进步:

来自主题: AI资讯
8306 点击    2026-07-09 09:50
OpenAI深夜放出GPT-Live,ChatGPT终于像真人一样说话

OpenAI深夜放出GPT-Live,ChatGPT终于像真人一样说话

OpenAI深夜放出GPT-Live,ChatGPT终于像真人一样说话

GPT-Live 基于全双工架构构建,也就是说,它可以同时听和说。在对话过程中,GPT-Live 可以用 mhmm 或 yeah 这样的回应表示自己正在听,也可以进行快速来回交流;当你需要一点时间思考时,它也会保持安静。最终带来的,是一种非常轻松自然的语音交互体验。

来自主题: AI资讯
9495 点击    2026-07-09 09:31
速递|AI语音ElevenLabs估值220亿美元,拟启动员工售股,IPO节奏放缓

速递|AI语音ElevenLabs估值220亿美元,拟启动员工售股,IPO节奏放缓

速递|AI语音ElevenLabs估值220亿美元,拟启动员工售股,IPO节奏放缓

ElevenLabs 已与投资者就让员工在二级市场出售股份进行早期洽谈,据知情人士称,这项要约将把这家人工智能初创公司的估值定在约 220 亿美元。两位知情人士补充说,这次要约收购可能会在二月一轮融资后将公司的估值翻一番,预计将在九月之前进行。知情人士表示,这些谈判仍处于早期阶段,且可能会发生变化;他们要求在讨论私人信息时不被点名。

来自主题: AI资讯
7947 点击    2026-07-06 10:20
全球第一! 中国模型登顶榜首,首个可编辑AI语音来了

全球第一! 中国模型登顶榜首,首个可编辑AI语音来了

全球第一! 中国模型登顶榜首,首个可编辑AI语音来了

全球第一!中国AI语音ViiTorVoice首创「局部编辑」神技:配音错字告别重录,像改Word一样修语音。内附姆巴佩、哈兰德爆笑实测,快来见证!这个凭空出世的中国模型,将 Qwen3-TTS、CosyVoice3、Fish Audio 等一众主流巨头挑落马下,径直登顶综合排名第一!

来自主题: AI资讯
8410 点击    2026-07-04 10:52
速递|千问输入法独立端Mac版本上线, 主打“说话即成稿”, AI自动润色

速递|千问输入法独立端Mac版本上线, 主打“说话即成稿”, AI自动润色

速递|千问输入法独立端Mac版本上线, 主打“说话即成稿”, AI自动润色

今天发现阿里刚刚把千问输入法做成了独立客户端,上线了 Mac 版本。我第一时间下载体验了一遍。结果比我预期更有意思。安装完成后,不需要登录,免费可用。

来自主题: AI资讯
7725 点击    2026-07-03 11:13
阿里云发布AI语音输入法“CosyVoice”,我发现了它的短板

阿里云发布AI语音输入法“CosyVoice”,我发现了它的短板

阿里云发布AI语音输入法“CosyVoice”,我发现了它的短板

千问输入法APP没等到,阿里云的全新AI输入法先上线了。 《读佳》获知,阿里云推出全新的AI语音输入法“CosyVoice”,这是一款以语音输入为主的智能语音输入法,支持多语种实时转写、方言识别、指令

来自主题: AI资讯
7677 点击    2026-06-28 10:55
实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!

实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!

实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!

火山引擎今天上线了全新的语音模型—— 豆包音频生成模型 1.0(Seed-Audio 1.0)。

来自主题: AI产品测评
8449 点击    2026-06-24 10:29
干掉 Whisper:我把 VoiceVault 迁移到 FunASR,本地转录加总结爽的飞起,已然是一枚离线录音加待办神器

干掉 Whisper:我把 VoiceVault 迁移到 FunASR,本地转录加总结爽的飞起,已然是一枚离线录音加待办神器

干掉 Whisper:我把 VoiceVault 迁移到 FunASR,本地转录加总结爽的飞起,已然是一枚离线录音加待办神器

把 VoiceVault 的转录引擎从 Whisper 迁移到 FunASR(sherpa-onnx),中文识别速度提升 3x,不再需要 500MB 的模型文件。但"切个后端"这件听起来很简单的事,让我在 GitHub Release 的 404、Tauri 白屏、trait object 生命周期和 CSP 策略里翻滚了一整天。

来自主题: AI技术研报
6022 点击    2026-06-18 15:28
正在升温的 Voice AI 赛道,出现了一家初创团队 Hojo

正在升温的 Voice AI 赛道,出现了一家初创团队 Hojo

正在升温的 Voice AI 赛道,出现了一家初创团队 Hojo

当所有人都在盯着通用大模型时,Voice AI 这条相对安静的赛道里,也开始出现一些值得注意的新模型。最近,一家名为 Hojo 的创业团队公开披露了一组语音识别测试结果,似乎有成为「黑马」的趋势。

来自主题: AI资讯
11533 点击    2026-06-10 20:07