深圳声音动力科技有限公司(以下简称“Noiz AI”)成立于2025年,是一家音频AI平台开发商,致力于通过先进的人工智能技术,为用户提供高效、便捷的声音与视频创作解决方案,满足用户在内容创作、娱乐互动等方面的需求。投资界(ID:pedaily2012)8月10日消息,Noiz AI已完成数千万元种子轮融资。最近一次融资来自金沙江创投,此前由北极光创投、英诺天使基金投资。目前Noiz全球用户已突破200万,ARR百万美元。
Noiz团队目前正职员工10余人。创始⼈陈伟嘉曾在Meta、Tiktok任职,做视频、ASR与Agent相关工作。回国后他创办玉符科技,做身份管理类SaaS,2020年公司被腾讯收购。随后,他在腾讯参与Agent模型的⼯程化落地,又经历了语⾳克隆、多模态模型和Coding等不同技术阶段,也是语⾳克隆开源项⽬Mockingbird的作者。
联合创始⼈陈前具有北⼤、清华和MIT的教育背景,此前曾任百川智能用户增长及运营负责人。⾸席科学家Zeyue Tian最早系统研究音视频联合生成的研究员之一,他开源的全曲生成模型ChatMusician曾被杨立昆转发。
团队其他成员来⾃Meta、Dolby、TikTok等公司和实验室,覆盖声⾳模型、多模态预训练、空间⾳频、产品⼯程和商业增长等⽅向,同时大多成员兼职乐队乐手及音乐创作。
在音频模型领域,Noiz不把⾃⼰定义为单⼀的配⾳⼯具或⾳频⽣成产品,⽽是⼀家从通⽤⾳频模型出发,逐步构建音视频智能底座的公司。在Noiz看来,新一代音频模型是对声⾳的产⽣、传播、空间响应及感知过程统⼀理解、⽣成与模拟的能⼒。
公司创立初期,Noiz自研开源音频模型底座AudioX,并以创作者⾳频产品Noiz AI进⼊市场,将技术放入产品接受付费验证。
Noiz AI⾯向短视频、内容制作和泛娱乐场景的创作者,提供语⾳、⾳乐、⾳效、视频配⾳和声⾳编辑能⼒。目前已积累约200万海外创作者,但C端用户并非Noiz主要现金来源,而是作为模型初期的数据雷达,指引AudioX不断迭代。
这一意识来自初次创业的“教训”。当时在研发身份认证Saas时,陈伟嘉带团队打磨技术,产品问世近20个月才尝试商业化,结果市场反馈不达预期。2020年正值疫情,腾讯会议用户规模大幅跃升,公司被腾讯收购,这才意外得到一个商业出口。以市场反馈指引技术也因此在陈伟嘉心里扎根。Noiz模型从第一代起就根据⽤⼾的实际制作和付费⾏为迭代。
C端用户外,Noiz目前还在同时用另外两类业务验证底层模型能力。一类是API与企业集成。同⼀套模型以API和系统集成的形式,进⼊内容平台、视频⽣产⼯具和企业⼯作流。企业客⼾可以根据业务需求调⽤语⾳、⾳乐、音视频、翻译和空间⾳频等不同能⼒。主要客户来自短剧、游戏、视频生产等领域。
另一类是3D与具⾝智能合作,目前Noiz正在把通⽤声⾳底座拓展到3D世界和具⾝智能。区别于给画⾯后期贴上⼀段⾳效,Noiz对于3D场景的目标在于根据⼏何结构、材质、距离和听者位置,⽣成匹配的空间声场。
对于机器⼈而言,听觉具有全向、连续和不受视线遮挡的特征。机器⼈可能通过声⾳更早感知⾝后的脚步、周围的碰撞、设备内部异常摩擦、⼀次动作是否产⽣了合理的物理结果等。
今年6月,团队发布AudioX-Turbo进⼀步解决⽣成速度问题。在团队看来,在⽆声视频⽣成声⾳的场景中,模型需要让脚步、碰撞、运动和画⾯中的事件尽可能同步发⽣,⽽非等待长时间离线渲染。这一模型也是帮助团队从离线内容制作⾛向交互式声学系统的基础,他们认为当声⾳能够⾜够快地⽣成,才有机会进⼊实时视频、游戏、虚拟⻆⾊和⼈机交互系统。
目前,随着底层模型逐渐统⼀,公司正在从“⽣成⾳频内容”,进⼀步⾛向“实时音视频交互”。
文章来源:投资界
原文地址:https://news.pedaily.cn/202608/567481.shtml
如有异议,请联系(editor@zero2ipo.com.cn)投资界处理。





