Smallest.ai 获1300万美元融资,打造听感自然、近乎真人的超快语音AI

TechCrunch AI 新闻

摘要

Smallest.ai 完成1300万美元A轮融资,用于开发小型专用语音模型,使AI智能体能够进行实时、类人的对话,旨在让语音交互与真人对话难以区分。

这家初创公司正在构建语音模型,旨在让AI电话通话通过图灵测试。
查看原文
查看缓存全文

缓存时间: 2026/07/31 16:57

# Smallest.ai 融资1300万美元,打造听感如真人的超快速语音AI | TechCrunch 来源:https://techcrunch.com/2026/07/31/smallest-ai-raises-13m-to-build-ultra-fast-voice-ai-that-sounds-genuinely-human/ 虽然AI智能体在解决客户支持问题方面的能力日益增强,但大多数人仍然能立刻分辨出和自己对话的是机器而非真人。 Smallest.ai(https://smallest.ai/)是一家成立于2024年底的初创公司,它认为语音智能体的下一次飞跃不是来自让大语言模型变得更快,而是来自使用为人类对话而构建的更小、更专用的模型。简而言之,该公司希望让与AI智能体的对话与和真人交谈难以区分。 为此,它正在开发一个小型语音模型,旨在模拟人类通过同时聆听、思考和说话来处理信息的方式。 “当我跟你说话时,你已经在思考,如果我说得太久,你可能会打断我,”Smallest.ai创始人兼CEO Sudarshan Kamath(左图)告诉TechCrunch,并补充说这正是该初创公司模型的设计工作方式。 为了推进这一使命,Smallest.ai已获得1300万美元的A轮融资,由Seligman Ventures领投,Sierra Ventures和3one4 Capital参投。这笔新资金使该初创公司的总融资额超过2100万美元。 “大语言模型的工作方式是,你给它一个完整的提示,然后它开始思考,”Kamath说。虽然这种延迟在文本聊天中可以接受,但在语音对话中,即使是一个短暂的停顿也会显得不自然。“如果你想想我们现在说话的方式,我并不是给你一大段音频,然后你才开始思考。” 该公司的模型充当一个实时智能层,能够以几乎零响应延迟在特定主题上进行自然的客户对话。但如果模型遇到其有限知识库之外的议题,Smallest.ai会将查询移交给大型基础模型,让客户短暂等待以“研究”该问题——就像真人会做的那样。 Kamath认为,所有AI智能体很快都将依赖两种模型:一种用于实时交互的小型语音模型,以及一种根据需要调用以解决复杂问题的“离线”大语言模型。 与大型基础模型不同,Smallest.ai严格专注于语音特有的细微之处,例如处理各种口音、支持数十种语言,以及在嘈杂环境中运行。 该公司的现有客户包括语音领域的公司,如RingCentral和Truecaller。Kamath表示,任何客户支持公司,包括Sierra和Decagon这样的新兴公司,都是该初创公司的潜在客户。 当被问及为什么资金充足的AI客户支持公司不自己构建语音模型时,Kamath表示,对于客户支持初创公司来说,变得“极其擅长语音处理会分散他们对核心业务的注意力。” Smallest.ai与语音AI领导者ElevenLabs,以及

相似文章

Thinnest AI

Product Hunt

Thinnest AI 推出了一个平台,用于在超过100种语言中构建语音AI智能体,定价为每分钟₹1.5。

本月语音AI重磅交易盘点

Reddit r/artificial

5月份,语音AI领域融资额超过18亿美元,其中Sierra的9.25亿美元和Hark的7亿美元融资轮次领跑。同时,ElevenLabs推出了用于音乐生成和配音的新模型,增强了控制功能。本简报还重点介绍了医疗领域的交易和印度不断增长的语音市场。

OpenAI的新语音模型不止于回话

Reddit r/ArtificialInteligence

OpenAI推出了三个新的实时音频模型,支持连续、多任务的语音交互,优先考虑长上下文推理、实时翻译和无缝工具使用。