Udio是一款于2024年4月上线的AI音乐生成平台,由前谷歌DeepMind的研究人员于2023年创立。
平台核心功能是通过文本描述生成包含人声、伴奏和完整结构的歌曲片段,初始时长约30-33秒,并支持“扩展”延长及“混音”微调,覆盖古典、爵士、流行、嘻哈、电子等多种流派,并提供社区分享与协作机制;该平台核心能力为生成包含人声与编曲的音频,不具备生成视频画面的功能。Udio采用免费增值模式,提供免费额度与付费订阅服务。Udio由一批前谷歌DeepMind员工创立,在伦敦和纽约设有办公室,联合创始人兼首席执行官David Ding(丁丰宁)曾参与谷歌Lyria模型的开发,并获得了包括a16z在内的投资及1000万美元种子轮融资。2024年6月,环球音乐、华纳音乐和索尼音乐起诉Udio,指控其使用未经授权的音乐数据进行模型训练。2025年6月,环球音乐、华纳音乐和索尼音乐与Udio探讨授权合作;同月,Udio推出可视化编辑工具“Sessions”,允许用户对歌曲结构进行智能编辑。2025年10月及11月,Udio分别与环球音乐集团、华纳音乐达成和解与战略合作协议,计划推出基于授权内容的订阅制平台,并建立相应的版税分成模式;与索尼音乐的诉讼仍在进行中。根据2026年3月的报道,Udio在2025年初就已具备生成长歌曲和灵活控制歌曲结构的能力。
Udio是由前谷歌DeepMind的研究人员于2023年创立的AI音乐生成平台。用户可在此发现音乐作品,上传个人创作并与他人交流。其定位为一款由AI驱动的音乐创作与分享平台,主要通过网页版使用。该平台操作流程较为直接,用户可将音乐灵感转化为作品,也可用于即兴创作。根据其官方介绍,Udio支持通过文本生成包含人声的完整音轨,提供音乐编辑与扩展功能,覆盖古典、爵士、流行、嘻哈、电子等多种流派,并设有社区分享与协作机制。该平台的功能可用于音乐创作尝试及音频内容制作。
2023年,Udio由一批前谷歌DeepMind的研究人员(包括David Ding等)创立,并获得a16z等机构约1000万美元种子轮融资。
2024年4月,Udio Beta版(v1)正式上线,因用户涌入导致服务器一度崩溃,测试期提供每月1200首免费生成额度。
2024年6月,环球音乐、华纳音乐和索尼音乐起诉Udio,指控其使用未经授权的音乐数据进行模型训练。
2025年初,Udio已具备生成完整歌曲结构(如前奏、主歌、副歌、桥段)的能力,支持长时长音乐生成。
2025年6月,Udio推出可视化编辑工具“Sessions”,允许用户对歌曲结构进行智能编辑。
2025年6月4日,环球音乐、华纳音乐和索尼音乐与AI音乐初创公司Udio等探讨授权合作的可能。如果谈判成功,将为生成式AI在使用音乐作品时如何对创作者进行补偿建立起制度性框架。
2025年10月及11月,Udio分别与环球音乐集团、华纳音乐达成和解与战略合作协议,计划推出基于授权内容的订阅制平台。
与索尼音乐的诉讼仍在进行中。
截至2026年3月,AI音乐训练数据的版权法律争议在行业内仍未形成定论。同期,主要竞争对手Google DeepMind发布其AI音乐模型Lyria 3 Pro时,亦因训练数据来源和授权问题面临类似质疑,凸显了包括Udio在内的AI音乐工具共同面临的版权挑战。
Udio由一批前谷歌DeepMind员工于2023年创立,在伦敦和纽约均设有办公室。联合创始人兼首席执行官David Ding(丁丰宁)是美籍华裔,曾就读于哈佛大学并获得数学学士与计算机科学硕士学位,于2018年加入谷歌DeepMind并参与Lyria模型的开发,于2023年离职并创立Udio。其他联合创始人包括Yaroslav Ganin、Charlie Nash、Conor Durkan和Andrew Sanchez,他们均拥有深厚的学术与技术背景,其中前三位曾任职于DeepMind并为Lyria模型做出研究贡献,Andrew Sanchez则曾担任Yext AI团队负责人。Udio获得了包括a16z、Instagram联合创始人Mike Krieger、谷歌Gemini负责人Oriol Vinyals以及音乐人will.i.am、Common等在内的投资,并已获得1000万美元的种子轮融资。
Udio采用免费增值模式,为用户提供免费使用额度,同时设有付费订阅服务以解锁更多功能。
定价计划
该服务提供免费与付费两种模式。免费计划提供有限的创作积分,支持歌曲生成、音视频导出及访问社区内容。付费订阅服务分为不同档位,包含音频上传、歌曲编辑、风格调整、高质量音频导出等功能,并可获得更多月度积分及新功能的早期访问权限。订阅服务通常为自动续订。
未来发展与合作
2024年,Udio曾因使用未经授权的音乐数据训练模型而被多家音乐公司起诉。至2025年底,Udio已与部分公司达成和解,并计划推出基于授权内容的订阅服务,建立相应的版税分成模式。
文本生成音乐:根据文字描述生成个性化音乐。
多风格支持:涵盖流行、摇滚、嘻哈等数十种风格。
音轨扩展定制:可延长时长并调整段落结构。
多语言歌声创作:支持J-pop、雷鬼等跨国界音乐。
社区分享功能:作品发布与音乐爱好者互动。
Udio采用两阶段技术,首先利用类似于ChatGPT的大语言模型生成歌词,然后利用一种未透露的方法合成音乐,可能是一种扩散模型,其模型或训练数据的具体细节没有披露。其生成作品风格覆盖流行、民谣、电子等。Udio被归类为“AI音乐模型”或“只出音频”类产品,其核心能力是生成包含人声与编曲的音频,不具备生成视频画面的功能。若需制作完整的音乐视频,用户需自行使用如Runway、Kaiber或剪映等外部视频工具生成画面,并手动完成音画同步与歌词字幕制作。
Udio生成的音乐在人声和器乐方面具有一定的还原能力。同时,Udio支持复杂编曲和动态层次,编曲细节和配器层次因作品而异,可生成电子、R&B、管弦类作品。其生成作品风格覆盖流行、民谣、电子等。Udio覆盖古典、爵士、流行、嘻哈、电子等多种流派。初始生成片段时长约为30-33秒,输入简单描述即可生成包含人声与编曲的歌曲,用户可通过“扩展”功能延长歌曲,并可使用“混音”功能进行微调。具体支持音乐编辑与扩展,如引子、过渡、尾声。同时,支持导出分轨文件,可导入本地专业音乐软件二次混音处理。但需注意,Udio的下载与导出存在限制,权利边界的公开说明相对模糊;免费版在下载与导出上的限制是其实际生产效率受影响的主要原因,使用Udio进行商业内容制作前需逐项确认所购套餐的授权范围。Udio在2025年初已具备生成长歌曲和灵活控制歌曲结构的能力。2025年6月,Udio推出了可视化编辑工具Sessions,允许用户对歌曲结构进行智能编辑。其可视化操作界面支持段落调整、局部重生成,可对提示词作出响应。此外,Udio提供社区分享与协作机制。在音质方面,Udio能够生成较高保真度的音频作品。Udio支持高保真音频输出,最高支持48kHz立体声输出,乐器分离度高,人声的颤音、情绪细节得到保留。
相较于同期竞品Suno,Udio在推出时提供了自定义选项和控制功能。Udio可用于探索海外语境下的多样音乐风格。2026年,与更专注于服务中文内容创作场景的音潮V4.0等工具相比,Udio在海外语境下的音乐风格生成上有所不同。局限:中文表现一般,多语种小语种能力弱于音潮;国内访问受限,免费版本生成额度有限。2026年8月,在一篇针对AI音乐创作软件的横向评测中,Udio与Suno等被列为海外主流AI写歌软件进行横向比较。评测建议采用同一提示词,并从中文自然度、歌曲结构、风格遵循、编辑成本四个维度进行公平比较,以评估不同工具的特点。2026年3月,Google DeepMind推出Lyria 3 Pro,将AI音乐生成时长延伸至3分钟并引入结构感知能力。与Lyria 3 Pro相比,Udio在生成时长和结构控制功能的推出时间较早。背靠Gemini生态的Lyria 3 Pro可能拥有较广泛的用户基础。Udio在部分风格(如摇滚乐)上的生成效果受到关注。
Udio支持中文、英语、日语、俄语、波兰语、德语、法语、意大利语等多种语言的音乐生成与识别。
Udio可用于生成对音质细节有要求的音乐,并支持在其生成基础上进行后期编辑。
该工具也应用于影视、播客等领域的配乐工作。
其应用包括生成高音质的英文Demo或氛围音乐,这一过程通常涉及多次生成与试错。
2026年9月的AI音乐软件推荐指南将Udio列为独立音乐人与编曲爱好者的推荐工具,适合将AI生成作品作为demo或素材进行后期精修;同时指出,在英文创作与专业后期场景下,Udio与Suno V5.5仍然是合适选择。
但需注意,Udio的免费额度通常不含商用授权,且下载与导出存在限制;若用于短视频、直播或客户项目等商业场景,需确认授权或升级付费。