#Udio

阿里 CosyVoice Studio 实测:一站式 AI 语音平台,能听能说能聊
8 月初,阿里接连发布多个重磅产品。 千问办公开启公测,对标 WorkBuddy;Qwen3.8-Max 正式上线,总参数量 2.4 万亿;视频生成模型 Wan3.0 开启公测,单次可生成 30 秒视频。 不过最值得关注的是阿里新上线的 C…
Cherry Studio V2 进阶玩法:Agent 自主执行、MCP 集成与 Skill 生态
Cherry Studio V2 今天上线了。这款 GitHub 上 49k Star 的开源软件之所以受欢迎,很重要的一个原因是它能接入市面上几乎所有模型供应商——无论是各种高性价比的在线模型,还是跑在本地电脑上的…
Cherry Studio V2.0 正式发布:从 AI 聊天客户端到 Agent 自主执行的全能工作站
Cherry Studio V2.0 正式发布,这不仅仅是一次功能更新,而是产品形态的跃迁——从 AI 聊天客户端到 Agent 自主执行的一站式全能 AI 工作站。 V2 数据底座重构 底层数据全面重构,更稳定、更…
Baz:专为软件演示与营销视频打造的AI生成器
Baz是一款AI视频生成器,专为软件演示和营销视频设计。通过一个提示即可生成完整视频,帮助团队快速创建品牌一致的内容。已被11000名创作者和多家知名企业使用。 Baz功能 一键生成完整视频:输入一个提示,即可生成完整视频,无需手动编辑…
Cherry Studio V2 内测开启:开源 AI 工作台全面升级
Cherry Studio V2 内测正式开启。这次他们换了一种方式——不是等最终版本才发布,而是在快速迭代中把产品交到用户手上,让每天使用 Cherry 的人参与决定它最终的样子。 V2 不是换皮,是"打地基" 过…
字节 Seed-Audio 1.0 实测:从语音合成到语音创作的突破
字节的多模态模型,这水准真的没得说。早上体验了他们新发的豆包音频生成模型 Seed-Audio 1.0,结果不废话,先看一个具体的 Case。 让它以杜甫的口吻吟诵《闻官军收河南河北》。声音表现、情绪起伏和声场氛围,全部是一个 Prompt…
AudioX-Turbo 开源音频生成模型:4 步极速出音效,支持文本/视频多模态输入
这个视频中,风刮玻璃、狂野感的森林环境音和鸟叫声、火球发射后爆炸声、布鞋踩在松软草原的脚步声——这些一系列场景的配音都是 AI 生成的。 今天要推荐的开源语音大模型 AudioX-Turbo,能把视频场景直接转成…
AI Agent 是什么:从对话式 AI 到任务执行者的关键转变
2022 年底 ChatGPT 爆火,让很多人第一次真正感受到 AI 的威力。在那之前,AI 对普通人来说更多像是一个遥远的技术词——听起来很厉害,但不知道跟自己的生活有什么关系。ChatGPT 出现之后,大家突然发…
OmniVoice Studio:免费开源AI语音生成工具,3秒克隆音色+视频自动配音
OmniVoice Studio 是一款完全开源、完全本地运行的 AI 语音工具,支持 646 种语言,4GB 内存即可运行,自带视频自动配音和 MCP 协议支持。 简单讲,它是一个本地语音工作站,集语音克隆、声音设计、视频翻配、实时听写于…
OmniVoice Studio:本地运行的开源 AI 声音克隆和视频配音工具
OmniVoice Studio:本地运行的开源 AI 声音克隆工具 OmniVoice Studio 是一个开源的 ElevenLabs 替代方案,支持实时听写、零样本语音克隆、视频配音,并且可以在桌面端本地运行。 对经常做视频、播客、课…