中国的神秘AI公司Naive AI估值超过14亿美元,可能最早在本月发布其首个开源大语言模型。
摘要
Naive AI是一家由中国清华大学教授戴继峰创立的AI初创公司,已融资4亿美元,估值达14亿美元,并计划很快发布其首个开源大语言模型,专注于修改现有架构以进行优化。
据知情人士透露,Naive AI是一家由清华大学教授戴继峰于今年二月创立的AI初创公司,已完成三轮融资,总额达4亿美元,使其估值超过14亿美元,获得独角兽地位。其投资者包括Tencent、IDG Capital、Matrix Partners China和Sequoia China。据了解,Naive AI在第一轮融资中筹集了1亿美元,第二轮1.8亿美元,最近完成的第三轮1.2亿美元,投后估值为14.2亿美元。尽管公司已成立超过七个月,但一直保持低调,员工人数少于100人。知情人士表示,Naive AI最早将于本月推出其首个大语言模型,同样命名为Naive,并将其作为开源权重模型发布。在技术路径上,Naive AI没有选择从头预训练的昂贵选项。相反,它正在修改现有中国开源权重模型的架构,然后通过中间训练、后训练和强化学习等过程不断优化,希望在多任务上实现更好的性能。目前尚无法确认其使用了哪个具体的基础模型。此外,Naive AI还在研究递归自我改进技术。即AI模型能够自动迭代和升级自身。https://www.theinformation.com/articles/tsinghua-professors-stealth-llm-startup-hits-1-4-billion-valuation
相似文章
一家中国AI初创公司即将实现10亿美元销售额,同时免费提供其最佳模型(3分钟阅读)
Z.ai(前身为Zhipu)有望成为第一家年度销售额约10亿美元的中国独立AI公司,这得益于企业部署和快速增长的云业务,同时将其最强大的GLM模型开源。
@cyrilXBT:中国刚刚打造了一款AI模型,以极低成本与OpenAI和Anthropic正面竞争。而且有人刚刚发布了一门免费课程……
DeepSeek是一款由中国量化对冲基金开发的AI模型,据报道其训练成本仅为GPT-4的约5%,却能达到相当的性能水平,引发了市场剧烈震荡,导致NVIDIA单日市值蒸发6000亿美元。目前已有人发布了一门时长1小时50分钟的免费课程,教用户如何在本地及通过API使用DeepSeek V4。
为什么中国在免费开放其最优秀的AI模型
中国AI公司如Moonshot AI和阿里巴巴正在免费发布强大的开放权重AI模型,通过培育生态系统并通过服务而非模型访问实现盈利,挑战美国的主导地位。
一款新型低成本中国AI模型正迎头赶上,挑战Anthropic和OpenAI的本土市场
一款新型低成本中国AI模型正迅速崛起,与Anthropic和OpenAI等美国顶级AI公司展开竞争。
@svpino:中国的人工智能生态系统与其他国家不同:每家公司都想发布自己的SOTA模型,但它们都…
该推文讨论了中国的人工智能生态系统,公司之间相互竞争但都发布开源模型。文中提到OpenRouter上出现了一个神秘模型'Owl Alpha',后被发现是美团的LongCat-2.0,这是一个1.6万亿参数模型,约480亿激活参数,针对推理和工具调用进行了优化。