@10xmylife: 崔添翼加入 DeepSeek 了,本科的时候看到他的博客惊为天人的感觉,怎么会有这么牛逼的人,期待下过段时间 DeepSeek 的产品吧
摘要
崔添翼(前Jane Street量化专家)于2025年3月加入DeepSeek,担任新组建的Harness团队负责人,研发对标Anthropic Claude Code的桌面端Agent产品。
查看缓存全文
缓存时间: 2026/05/22 05:51
崔添翼加入 DeepSeek 了,本科的时候看到他的博客惊为天人的感觉,怎么会有这么牛逼的人,期待下过段时间 DeepSeek 的产品吧
思维怪怪 (@0xLogicrw): 前量化投资机构 TSY Capital 联合创始人、曾在华尔街量化巨头 Jane Street 履职 9 年的崔添翼已于今年 3 月正式加盟 DeepSeek,出任其全新组建的 Harness 团队负责人,挂帅研发直接对标 Anthropic 旗下 Claude Code 的桌面端 Agent 产品。
崔添翼曾在本科期间 6 次斩获 ACM
相似文章
Antirez 在 HF 上发布 Deepseek 4.1 flash gguf 模型
Antirez 已将 Deepseek 4.1 flash 模型的量化 gguf 版本上传至 Hugging Face,部分可用,并有关于使用方法的疑问。
@xiaomovps:发现免费使用 Deepseek V4.1 Flash 的方法 Workbuddy 国际版已同步推出 Deepseek V4.1 Flash…
Workbuddy 国际版已推出 Deepseek V4.1 Flash,无需排队即可免费使用,且速度极快。
@0x0SojalSec: 你不需要256GB+ RAM来本地运行DeepSeek-V4.1-Flash 763B模型, - 仅需64GB系统RAM。 - 将一个2…卸载到NVMe
本文解释了如何仅用64GB RAM本地运行DeepSeek-V4.1-Flash 763B模型,通过将200GB Engram卸载到NVMe并使用DSpark,在4块Max-Q卡上实现200 TPS。
Livebench 新增 Deepseek v4.1 flash 评测
Livebench 已将 Deepseek v4.1 flash 纳入其评测体系,结果显示其性能与 5.6 sol 持平,但成本仅为后者的十分之一以下。
@joey00072fp4: DeepSeek-V4.1-Flash, 两阶段解码器架构, 20+20=40层 前20层构建csa2和swa的全局KV(称为e…
DeepSeek-V4.1-Flash引入了两阶段解码器架构,具有40层,在预填充期间仅激活8B参数,在解码期间激活16B参数,并包含196B Engram内存,相比之前的版本在效率上有显著提升。