关于DeepSeek的笔记
摘要
参观DeepSeek总部后,可见其低调的出身、年轻的团队和独特的文化。这家公司由一家对冲基金运营,专注于保持小规模,且对AGI风险并不担忧,而是更关注失业等社会问题。
查看缓存全文
缓存时间: 2026/06/10 14:46
关于DeepSeek的笔记:
上周二我们参访了该公司总部。该公司由梁文峰于2023年创立,直至近期一直以其对冲基金High-Flyer为运营载体。公司于2025年1月发布了R1模型,因此了解他们过去一年半的动向颇有意思。
公司位于杭州一栋无标识的12层建筑内。街道或大堂均看不到DeepSeek的品牌标识。当问及原因时,团队婉言道:“这栋楼里有很多公司,我们并不特殊。“他们希望保持低调。
我们会见了数据负责人和基础设施负责人。公司仅有300名员工,规模至少比Anthropic小一个数量级,且暂时无意继续扩张。基础设施负责人尤为年轻,大约30岁,据称是中国顶尖的AI建设与能源专家之一。(我们短暂参观了实验室,所有人看起来都很年轻。讨论氛围热烈,让人感受到这是个充满活力与激情的地方。)
阿里巴巴(通义千问)、字节跳动和月之暗面(Kimi)带来的竞争激烈。中国用户似乎主要使用Kimi或DeepSeek。年轻人通过VPN访问Claude,但Anthropic针对中国用户设置了使用限制。团队间挖角在美国和中国同样常见。DeepSeek以“聪明“和“酷“著称,风格或许与Anthropic类似。大型实验室大多集中于北京清华北大附近,杭州是主要例外(DeepSeek与阿里巴巴/通义千问均在此地)。
DeepSeek团队阅读西方AI作者的文章,收听Dwarkesh的播客并阅读Gwern的博客。受访者表示从未与Anthropic员工会面。他们对某种敌对式/AGI接管场景毫不担忧,反而反复提及就业问题(中国年轻人失业率本已较高)是主要关切。当问及是否对模型进行红队测试时,他们回答没有。在中国,AI模型不受直接监管,政府仅限制这些模型在软件、服务等场景中的使用方式。
总体而言,中国将AI视作普通技术而非某种奇点时刻。国家层面仍聚焦基本需求、基础设施建设和药物供给。“奇点梦想“似乎属于奢侈品或遥远议题。
我们询问DeepSeek团队:“迄今为止的亮点是什么?你们对退出的计划是什么?“他们表示亮点和伟大成就是R1。他们没有指向未来模型或愿景,反而对已完成的工作最为自豪。他们目前满足于保持比美国公司落后约6个月的状态,同时维持低调和精简的团队规模。
相似文章
DeepSeek推进102.9亿美元融资轮,梁文峰承诺继续开发开源AI模型而非追求短期商业化目标
DeepSeek正在进行102.9亿美元融资,创始人梁文峰重申致力于开源AI开发和长期AGI目标,而非短期商业化。
@mark_k: 关于DeepSeek AI(@deepseek_ai)的一篇引人入胜且非常深刻的分析文章。你绝对猜不到他们的策略是什么……
对DeepSeek AI非常规策略的分析:优先采用激进架构创新(MoE、MLA、engram、mHC),大幅降低计算和内存需求,从而实现长期布局,构建一个10万亿人民币的中国AI硬件生态系统,并追求1万亿美元估值。
DeepSeek 拒绝阿里投资:坚守企业独立性,而非融入巨头生态
尽管中国科技巨头表现出浓厚兴趣,但 DeepSeek 已拒绝阿里巴巴的投资,以维持企业独立性并避免受限的生态系统整合条款。该公司寻求融资主要用于获取算力和保留人才,同时最大限度地减少外部对其商业化议程的控制。
AI 初创公司 DeepSeek 预计估值将达 740 亿美元(3 分钟阅读)
AI 初创公司 DeepSeek 正寻求融资 74 亿美元,用于研发和计算基础设施建设,目标估值 740 亿美元。
DeepSeek 年经常性收入接近 5 亿美元,估值 710 亿美元的 AI 初创公司考虑 IPO,与 OpenAI 和 Anthropic 并肩
据报道,DeepSeek 年经常性收入(ARR)接近 5 亿美元,估值 710 亿美元,并计划在上海的 STAR Market 上市,与此同时 OpenAI 和 Anthropic 等 AI 公司也正走向公开市场。