全球第一! 中国模型登顶榜首,首个可编辑AI语音来了
全球第一! 中国模型登顶榜首,首个可编辑AI语音来了全球第一!中国AI语音ViiTorVoice首创「局部编辑」神技:配音错字告别重录,像改Word一样修语音。内附姆巴佩、哈兰德爆笑实测,快来见证!这个凭空出世的中国模型,将 Qwen3-TTS、CosyVoice3、Fish Audio 等一众主流巨头挑落马下,径直登顶综合排名第一!
搜索
全球第一!中国AI语音ViiTorVoice首创「局部编辑」神技:配音错字告别重录,像改Word一样修语音。内附姆巴佩、哈兰德爆笑实测,快来见证!这个凭空出世的中国模型,将 Qwen3-TTS、CosyVoice3、Fish Audio 等一众主流巨头挑落马下,径直登顶综合排名第一!
今天发现阿里刚刚把千问输入法做成了独立客户端,上线了 Mac 版本。我第一时间下载体验了一遍。结果比我预期更有意思。安装完成后,不需要登录,免费可用。
千问输入法APP没等到,阿里云的全新AI输入法先上线了。 《读佳》获知,阿里云推出全新的AI语音输入法“CosyVoice”,这是一款以语音输入为主的智能语音输入法,支持多语种实时转写、方言识别、指令
火山引擎今天上线了全新的语音模型—— 豆包音频生成模型 1.0(Seed-Audio 1.0)。
把 VoiceVault 的转录引擎从 Whisper 迁移到 FunASR(sherpa-onnx),中文识别速度提升 3x,不再需要 500MB 的模型文件。但"切个后端"这件听起来很简单的事,让我在 GitHub Release 的 404、Tauri 白屏、trait object 生命周期和 CSP 策略里翻滚了一整天。
当所有人都在盯着通用大模型时,Voice AI 这条相对安静的赛道里,也开始出现一些值得注意的新模型。最近,一家名为 Hojo 的创业团队公开披露了一组语音识别测试结果,似乎有成为「黑马」的趋势。
最近看到了一个音频转文字的 AI 工具站:turboscribe.ai。
Boson AI 与 SGLang-Omni 团队宣布,SGLang-Omni 已完成对 Higgs Audio v3 TTS 的端到端 Serving 支持。作为一家成立于 2023 年的 AI 基础设施公司,李沐与 Alex Smola共同创立了 Boson AI,聚焦大模型时代的系统与基础设施创新。
Apple 必须面对它过去三年最难堪的一个问题——为什么全世界最贵的智能手机,装着一个最蠢的 AI 助手?当地时间 5 月 28 日,在发布会前十天,外媒率先曝光了答案。
据一位熟悉该收购的人士透露,OpenAI 在一月收购了 Weights.GG, 这是一家开发了名为 Replay 的 AI 语音克隆工具的小型创业公司。大约六名员工加入了 OpenAI,OpenAI 收购了该创业公司的知识产权,但并不打算整合该创业公司的产品。