西雅图人工智能研究实验室 Nuance Labs 于 9 月 14 日宣布完成 5000 万美元 A 轮融资。本轮融资由老股东光速创投(Lightspeed Venture Partners)领投,Accel 与 South Park Commons 继续跟投,英伟达(NVIDIA)与 Define Ventures 为新进投资方。公司同时披露,其在研的“人类对话与表达”视听基础模型计划年内向公众开放研究预览版。
这是该公司继 2025 年 9 月由 Accel 领投的 1000 万美元种子轮之后完成的首笔大额融资,累计披露融资规模达 6000 万美元。据美国证监会(SEC)备案文件与行业媒体报道,本轮融资的推进远早于官宣:3 月提交的 Form D 文件显示,公司当时已出售约 4670 万美元证券,本轮额度上限约为 6080 万美元,光速创投合伙人 Nnamdi Iregbulem 已列入公司董事名单。新资金将用于加速模型研发、扩充研究团队,并支持公司首次公开研究预览。
Nuance Labs 由三名前苹果博士研究员创立:Fangchang Ma 出任首席执行官,Edward Zhang 出任首席技术官,Karren Yang 出任首席科学家,Yaser Sheikh 担任顾问。三人此前长期在苹果研究机器如何感知与重建人的问题,其中 Ma 与 Zhang 曾参与 Apple Vision Pro 的 Digital Persona 数字形象系统。公开资料显示,Ma 拥有麻省理工学院机器人与机器学习博士学位,Zhang 毕业于华盛顿大学计算机图形学方向,Yang 同样出身麻省理工学院,曾在苹果从事视听生成研究。据公司官网,团队已扩充至 20 余人,本轮融资后将进一步扩大研究力量。
在官方叙述中,“面对面 AI”进展缓慢的症结出在技术管线上:现有数字人系统大多将语音识别、大语言模型、语音合成与面部动画拼接而成——语音先被转成文字,语言模型决定说什么,再由语音模型发声、动画系统对口型。公告称,多环节交接会丢失语气、犹豫、目光与手势等信息,并层层叠加延迟,导致数字形象常常呆滞不动、抢话,或干脆跟不上对话节奏。Nuance Labs 的方案是以单一全双工基础模型替代整条管线:一边流式读入用户的音视频信号,一边同步生成带面部表情与语音的视听回应,使用户尚未说完时,模型就能以语言与非语言信号示意“我听懂了”。官方强调,实时响应内置于模型架构本身,而非事后叠加的能力。
Ma 在公告中说:“当 AI 和虚拟形象呆滞地盯着你、或不断打断你的时候,它们改善生活的潜力就永远无法实现。它们之所以从未让人感觉自然,是因为我们一直在迁就机器、扭曲自己的表达方式,而不是让机器来适应我们。”他表示,最富成效的协作来自像与好友或亲密同事交流那样,用语言、语气、手势与表情自由表达,“这正是我们在 Nuance Labs 构建的东西:理解人类多种表达方式、并像人一样即时回应的 AI。”领投方光速创投合伙人 Iregbulem 表示:“修复人与变革性 AI 工具的交互方式,蕴含着巨大机会。Nuance Labs 正在打造的,是一个能像人一样看见并回应人的界面。创始团队兼具技术深度与执行能力,我们相信它会成为各类 AI 产品赖以构建的基础层。”
官方将销售与客服、教练辅导、职业培训和教育列为优先落地场景。本轮新进投资方中的英伟达(NVIDIA),是该公司首度引入的产业资本。研究预览版计划于 2026 年内向公众开放,有意者可通过公司官网登记等候名单。
融资概览
轮次 | A 轮 |
宣布时间 | 2026 年 9 月 14 日 |
融资金额 | 5000 万美元 |
领投方 | 光速创投 Lightspeed Venture Partners(老股东) |
跟投方 | Accel、South Park Commons(均为老股东) |
新进投资方 | 英伟达(NVIDIA)、Define Ventures |
累计融资 | 6000 万美元(含 2025 年 9 月 1000 万美元种子轮) |
资金用途 | 模型研发、扩充研究团队、支持首次公开研究预览 |