6.3
深览指数
产品TechCrunch·Marina Temkin··AI 生成

Smallest.ai 获 1300 万美元融资,打造听上去像真人的超快语音 AI

Small voice model 初创公司 Smallest.ai 获 1300 万美元 A 轮融资,主张语音 AI 的下一突破不在大模型速度,而在专为对话设计的轻量小模型。其核心技术是让模型实现「听、想、说」同步,近乎零延迟,并在遇到未知问题时自动转接大模型处理——模仿人类对话中的「思考停顿」和「查资料」行为。对于关注语音交互产品设计、小模型 vs 大模型路线之争的投资人和从业者,这篇文章提供了不同于「堆算力」思路的另一种实践方案。原文 ↗

核心观点
  • Smallest.ai 认为语音 AI 的下一步不是让大语言模型更快,而是用专为对话设计的轻量小模型实现「听、想、说」同步,从而让 AI 语音难以被辨认为机器。
  • 未来所有 AI 代理将依赖双模型架构:一个用于实时语音交互的小模型,加上一个按需调用、解决复杂问题的「离线」大模型。
  1. 01Smallest.ai 成立于 2024 年底,已获 1300 万美元 A 轮融资,由 Seligman Ventures 领投,总融资额超过 2100 万美元。
  2. 02其模型在处理超出知识库的问题时,会暂时让客户「等待」,然后转接大模型「研究」问题,模仿人类查资料的行为。
  3. 03现有客户包括 RingCentral 和 Truecaller 等语音领域公司。
  4. 04Smallest.ai 专注于语音特有的细微之处,如处理多种口音、支持数十种语言、以及在嘈杂环境下运行。
  5. 05公司 CEO 认为,对于客户支持初创公司来说,「把语音做到极致会分散他们在核心业务上的注意力」,这解释了为何它们未必自建语音模型。
反方 / 局限
  • 文章未提及该小模型在「降噪、口音、语言」等具体能力上的量化指标,也未说明在复杂多轮对话中与 ElevenLabs 等竞品的对比表现。
  • 「转接大模型」带来的短暂停顿,在用户实际体验中是否真能媲美人类「自然停顿」,仍存不确定性。
8 分钟 · 4 卡片 · 11 资料
读原文 →

前置背景

平行视角

未来推演

延伸追问