Smallest.ai 获1300万美元融资,打造听感自然、近乎真人的超快语音AI
摘要
Smallest.ai 完成1300万美元A轮融资,用于开发小型专用语音模型,使AI智能体能够进行实时、类人的对话,旨在让语音交互与真人对话难以区分。
这家初创公司正在构建语音模型,旨在让AI电话通话通过图灵测试。
查看缓存全文
缓存时间: 2026/07/31 16:57
# Smallest.ai 融资1300万美元,打造听感如真人的超快速语音AI | TechCrunch
来源:https://techcrunch.com/2026/07/31/smallest-ai-raises-13m-to-build-ultra-fast-voice-ai-that-sounds-genuinely-human/
虽然AI智能体在解决客户支持问题方面的能力日益增强,但大多数人仍然能立刻分辨出和自己对话的是机器而非真人。
Smallest.ai(https://smallest.ai/)是一家成立于2024年底的初创公司,它认为语音智能体的下一次飞跃不是来自让大语言模型变得更快,而是来自使用为人类对话而构建的更小、更专用的模型。简而言之,该公司希望让与AI智能体的对话与和真人交谈难以区分。
为此,它正在开发一个小型语音模型,旨在模拟人类通过同时聆听、思考和说话来处理信息的方式。
“当我跟你说话时,你已经在思考,如果我说得太久,你可能会打断我,”Smallest.ai创始人兼CEO Sudarshan Kamath(左图)告诉TechCrunch,并补充说这正是该初创公司模型的设计工作方式。
为了推进这一使命,Smallest.ai已获得1300万美元的A轮融资,由Seligman Ventures领投,Sierra Ventures和3one4 Capital参投。这笔新资金使该初创公司的总融资额超过2100万美元。
“大语言模型的工作方式是,你给它一个完整的提示,然后它开始思考,”Kamath说。虽然这种延迟在文本聊天中可以接受,但在语音对话中,即使是一个短暂的停顿也会显得不自然。“如果你想想我们现在说话的方式,我并不是给你一大段音频,然后你才开始思考。”
该公司的模型充当一个实时智能层,能够以几乎零响应延迟在特定主题上进行自然的客户对话。但如果模型遇到其有限知识库之外的议题,Smallest.ai会将查询移交给大型基础模型,让客户短暂等待以“研究”该问题——就像真人会做的那样。
Kamath认为,所有AI智能体很快都将依赖两种模型:一种用于实时交互的小型语音模型,以及一种根据需要调用以解决复杂问题的“离线”大语言模型。
与大型基础模型不同,Smallest.ai严格专注于语音特有的细微之处,例如处理各种口音、支持数十种语言,以及在嘈杂环境中运行。
该公司的现有客户包括语音领域的公司,如RingCentral和Truecaller。Kamath表示,任何客户支持公司,包括Sierra和Decagon这样的新兴公司,都是该初创公司的潜在客户。
当被问及为什么资金充足的AI客户支持公司不自己构建语音模型时,Kamath表示,对于客户支持初创公司来说,变得“极其擅长语音处理会分散他们对核心业务的注意力。”
Smallest.ai与语音AI领导者ElevenLabs,以及
相似文章
Thinnest AI
Thinnest AI 推出了一个平台,用于在超过100种语言中构建语音AI智能体,定价为每分钟₹1.5。
Fish Audio 获得5200万美元种子轮融资,面向创作者和企业构建AI语音模型
Fish Audio 已获得5200万美元种子轮融资,用于面向创作者和企业开发AI语音模型。这家初创公司年经常性收入(ARR)达2100万美元,拥有800万用户,提供开源和付费语音生成模型,包括其最新的S2.1 Pro API。
Encore AI 获得3000万美元融资,打造能从客户电话中学习的AI代理
Encore AI 已筹集3000万美元,用于开发通过分析通话录音和文字记录来从客户互动中学习的AI语音代理。
本月语音AI重磅交易盘点
5月份,语音AI领域融资额超过18亿美元,其中Sierra的9.25亿美元和Hark的7亿美元融资轮次领跑。同时,ElevenLabs推出了用于音乐生成和配音的新模型,增强了控制功能。本简报还重点介绍了医疗领域的交易和印度不断增长的语音市场。
OpenAI的新语音模型不止于回话
OpenAI推出了三个新的实时音频模型,支持连续、多任务的语音交互,优先考虑长上下文推理、实时翻译和无缝工具使用。