中国的神秘AI公司Naive AI估值超过14亿美元,可能最早在本月发布其首个开源大语言模型。

Reddit r/LocalLLaMA 模型

摘要

Naive AI是一家由中国清华大学教授戴继峰创立的AI初创公司,已融资4亿美元,估值达14亿美元,并计划很快发布其首个开源大语言模型,专注于修改现有架构以进行优化。

据知情人士透露,Naive AI是一家由清华大学教授戴继峰于今年二月创立的AI初创公司,已完成三轮融资,总额达4亿美元,使其估值超过14亿美元,获得独角兽地位。其投资者包括Tencent、IDG Capital、Matrix Partners China和Sequoia China。据了解,Naive AI在第一轮融资中筹集了1亿美元,第二轮1.8亿美元,最近完成的第三轮1.2亿美元,投后估值为14.2亿美元。尽管公司已成立超过七个月,但一直保持低调,员工人数少于100人。知情人士表示,Naive AI最早将于本月推出其首个大语言模型,同样命名为Naive,并将其作为开源权重模型发布。在技术路径上,Naive AI没有选择从头预训练的昂贵选项。相反,它正在修改现有中国开源权重模型的架构,然后通过中间训练、后训练和强化学习等过程不断优化,希望在多任务上实现更好的性能。目前尚无法确认其使用了哪个具体的基础模型。此外,Naive AI还在研究递归自我改进技术。即AI模型能够自动迭代和升级自身。https://www.theinformation.com/articles/tsinghua-professors-stealth-llm-startup-hits-1-4-billion-valuation
查看原文

相似文章

@cyrilXBT:中国刚刚打造了一款AI模型,以极低成本与OpenAI和Anthropic正面竞争。而且有人刚刚发布了一门免费课程……

X AI KOLs Timeline

DeepSeek是一款由中国量化对冲基金开发的AI模型,据报道其训练成本仅为GPT-4的约5%,却能达到相当的性能水平,引发了市场剧烈震荡,导致NVIDIA单日市值蒸发6000亿美元。目前已有人发布了一门时长1小时50分钟的免费课程,教用户如何在本地及通过API使用DeepSeek V4。