深圳声音动力科技有限公司(以下简称 "Noiz AI")成立于 2025 年,是一家音频 AI 平台开发商,致力于通过先进的人工智能技术,为用户提供高效、便捷的声音与视频创作解决方案,满足用户在内容创作、娱乐互动等方面的需求。投资界(ID:pedaily2012)8 月 10 日消息,Noiz AI 已完成数千万元种子轮融资。最近一次融资来自金沙江创投,此前由北极光创投、英诺天使基金投资。目前 Noiz 全球用户已突破 200 万,ARR 百万美元。
Noiz 团队目前正职员工 10 余人。创始⼈陈伟嘉曾在 Meta、Tiktok 任职,做视频、ASR 与 Agent 相关工作。回国后他创办玉符科技,做身份管理类 SaaS,2020 年公司被腾讯收购。随后,他在腾讯参与 Agent 模型的⼯程化落地,又经历了语⾳克隆、多模态模型和 Coding 等不同技术阶段,也是语⾳克隆开源项⽬ Mockingbird 的作者。
联合创始⼈陈前具有北⼤、清华和 MIT 的教育背景,此前曾任百川智能用户增长及运营负责人。⾸席科学家 Zeyue Tian 最早系统研究音视频联合生成的研究员之一,他开源的全曲生成模型 ChatMusician 曾被杨立昆转发。
团队其他成员来⾃ Meta、Dolby、TikTok 等公司和实验室,覆盖声⾳模型、多模态预训练、空间⾳频、产品⼯程和商业增长等⽅向,同时大多成员兼职乐队乐手及音乐创作。
在音频模型领域,Noiz 不把⾃⼰定义为单⼀的配⾳⼯具或⾳频⽣成产品,⽽是⼀家从通⽤⾳频模型出发,逐步构建音视频智能底座的公司。在 Noiz 看来,新一代音频模型是对声⾳的产⽣、传播、空间响应及感知过程统⼀理解、⽣成与模拟的能⼒。
公司创立初期,Noiz 自研开源音频模型底座 AudioX,并以创作者⾳频产品 Noiz AI 进⼊市场,将技术放入产品接受付费验证。
Noiz AI ⾯向短视频、内容制作和泛娱乐场景的创作者,提供语⾳、⾳乐、⾳效、视频配⾳和声⾳编辑能⼒。目前已积累约 200 万海外创作者,但 C 端用户并非 Noiz 主要现金来源,而是作为模型初期的数据雷达,指引 AudioX 不断迭代。
这一意识来自初次创业的 " 教训 "。当时在研发身份认证 Saas 时,陈伟嘉带团队打磨技术,产品问世近 20 个月才尝试商业化,结果市场反馈不达预期。2020 年正值疫情,腾讯会议用户规模大幅跃升,公司被腾讯收购,这才意外得到一个商业出口。以市场反馈指引技术也因此在陈伟嘉心里扎根。Noiz 模型从第一代起就根据⽤⼾的实际制作和付费⾏为迭代。
C 端用户外,Noiz 目前还在同时用另外两类业务验证底层模型能力。一类是 API 与企业集成。同⼀套模型以 API 和系统集成的形式,进⼊内容平台、视频⽣产⼯具和企业⼯作流。企业客⼾可以根据业务需求调⽤语⾳、⾳乐、音视频、翻译和空间⾳频等不同能⼒。主要客户来自短剧、游戏、视频生产等领域。
另一类是 3D 与具⾝智能合作,目前 Noiz 正在把通⽤声⾳底座拓展到 3D 世界和具⾝智能。区别于给画⾯后期贴上⼀段⾳效,Noiz 对于 3D 场景的目标在于根据⼏何结构、材质、距离和听者位置,⽣成匹配的空间声场。
对于机器⼈而言,听觉具有全向、连续和不受视线遮挡的特征。机器⼈可能通过声⾳更早感知⾝后的脚步、周围的碰撞、设备内部异常摩擦、⼀次动作是否产⽣了合理的物理结果等。
今年 6 月,团队发布 AudioX-Turbo 进⼀步解决⽣成速度问题。在团队看来,在⽆声视频⽣成声⾳的场景中,模型需要让脚步、碰撞、运动和画⾯中的事件尽可能同步发⽣,⽽非等待长时间离线渲染。这一模型也是帮助团队从离线内容制作⾛向交互式声学系统的基础,他们认为当声⾳能够⾜够快地⽣成,才有机会进⼊实时视频、游戏、虚拟⻆⾊和⼈机交互系统。
目前,随着底层模型逐渐统⼀,公司正在从 " ⽣成⾳频内容 ",进⼀步⾛向 " 实时音视频交互 "。
文章来源:投资界
原文地址:https://news.pedaily.cn/202608/567481.shtml
【本文根据公开消息发布,不构成任何投资建议。市场有风险,投资需谨慎。】
如有异议,请联系(editor@zero2ipo.com.cn)投资界处理。


