前苹果研究员创立的 Nuance Labs 完成 5000 万美元 A 轮融资,英伟达入局

来源:爱集微 #英伟达# #Nuance# #视听模型#
409

西雅图人工智能研究实验室 Nuance Labs 于 9 月 14 日宣布完成 5000 万美元 A 轮融资。本轮融资由老股东光速创投(Lightspeed Venture Partners)领投,Accel 与 South Park Commons 继续跟投,英伟达(NVIDIA)与 Define Ventures 为新进投资方。公司同时披露,其在研的“人类对话与表达”视听基础模型计划年内向公众开放研究预览版。

这是该公司继 2025 年 9 月由 Accel 领投的 1000 万美元种子轮之后完成的首笔大额融资,累计披露融资规模达 6000 万美元。据美国证监会(SEC)备案文件与行业媒体报道,本轮融资的推进远早于官宣:3 月提交的 Form D 文件显示,公司当时已出售约 4670 万美元证券,本轮额度上限约为 6080 万美元,光速创投合伙人 Nnamdi Iregbulem 已列入公司董事名单。新资金将用于加速模型研发、扩充研究团队,并支持公司首次公开研究预览。

Nuance Labs 由三名前苹果博士研究员创立:Fangchang Ma 出任首席执行官,Edward Zhang 出任首席技术官,Karren Yang 出任首席科学家,Yaser Sheikh 担任顾问。三人此前长期在苹果研究机器如何感知与重建人的问题,其中 Ma 与 Zhang 曾参与 Apple Vision Pro 的 Digital Persona 数字形象系统。公开资料显示,Ma 拥有麻省理工学院机器人与机器学习博士学位,Zhang 毕业于华盛顿大学计算机图形学方向,Yang 同样出身麻省理工学院,曾在苹果从事视听生成研究。据公司官网,团队已扩充至 20 余人,本轮融资后将进一步扩大研究力量。

在官方叙述中,“面对面 AI”进展缓慢的症结出在技术管线上:现有数字人系统大多将语音识别、大语言模型、语音合成与面部动画拼接而成——语音先被转成文字,语言模型决定说什么,再由语音模型发声、动画系统对口型。公告称,多环节交接会丢失语气、犹豫、目光与手势等信息,并层层叠加延迟,导致数字形象常常呆滞不动、抢话,或干脆跟不上对话节奏。Nuance Labs 的方案是以单一全双工基础模型替代整条管线:一边流式读入用户的音视频信号,一边同步生成带面部表情与语音的视听回应,使用户尚未说完时,模型就能以语言与非语言信号示意“我听懂了”。官方强调,实时响应内置于模型架构本身,而非事后叠加的能力。

Ma 在公告中说:“当 AI 和虚拟形象呆滞地盯着你、或不断打断你的时候,它们改善生活的潜力就永远无法实现。它们之所以从未让人感觉自然,是因为我们一直在迁就机器、扭曲自己的表达方式,而不是让机器来适应我们。”他表示,最富成效的协作来自像与好友或亲密同事交流那样,用语言、语气、手势与表情自由表达,“这正是我们在 Nuance Labs 构建的东西:理解人类多种表达方式、并像人一样即时回应的 AI。”领投方光速创投合伙人 Iregbulem 表示:“修复人与变革性 AI 工具的交互方式,蕴含着巨大机会。Nuance Labs 正在打造的,是一个能像人一样看见并回应人的界面。创始团队兼具技术深度与执行能力,我们相信它会成为各类 AI 产品赖以构建的基础层。”

官方将销售与客服、教练辅导、职业培训和教育列为优先落地场景。本轮新进投资方中的英伟达(NVIDIA),是该公司首度引入的产业资本。研究预览版计划于 2026 年内向公众开放,有意者可通过公司官网登记等候名单。

融资概览

轮次

A 轮

宣布时间

2026 年 9 月 14 日

融资金额

5000 万美元

领投方

光速创投 Lightspeed Venture Partners(老股东)

跟投方

Accel、South Park Commons(均为老股东)

新进投资方

英伟达(NVIDIA)、Define Ventures

累计融资

6000 万美元(含 2025 年 9 月 1000 万美元种子轮)

资金用途

模型研发、扩充研究团队、支持首次公开研究预览


责编: 爱集微
来源:爱集微 #英伟达# #Nuance# #视听模型#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...