@yvbbrjdr: 推荐大家读一下MAI-Thinking-1的技术论文,里面有详细的怎么训出一个SOTA大语言模型的(几乎)所有细节。 https://microsoft.ai/wp-content/uploads/2026/06/ma…
摘要
推荐阅读MAI-Thinking-1的技术论文,其中详细介绍了训练SOTA大语言模型的几乎全部细节。
查看缓存全文
缓存时间: 2026/06/03 05:44
推荐大家读一下MAI-Thinking-1的technical paper,里面有详细的怎么训出一个SOTA LLM的(几乎)所有细节。 https://microsoft.ai/wp-content/uploads/2026/06/main_20260602_2.pdf… — Source: https://microsoft.ai/wp-content/uploads/2026/06/main_20260602_2.pdf
相似文章
@Jolyne_AI: 一本开源实战书:《Hands-On Large Language Models》(《动手学大模型》)。 全书 12 章,从语言模型基础到提示词工程、语义搜索、模型微调,再到多模态应用,循序渐进,覆盖大模型落地的关键路径。 GitHub:h…
一本开源实战书《Hands-On Large Language Models》(《动手学大模型》),全书12章,覆盖语言模型基础、提示词工程、语义搜索、模型微调及多模态应用,提供可运行代码示例,适合实战学习。
@PandaTalk8: 1/ 最近读到一本很适合系统补 LLM 基础的书: 《Foundations of Large Language Models》 作者是 Tong Xiao 和 Jingbo Zhu,来自中国东北大学 NLP Lab 与 NiuTrans…
推荐一本系统学习大型语言模型基础的中文书籍《Foundations of Large Language Models》,由东北大学 NLP Lab 与 NiuTrans Research 的 Tong Xiao 和 Jingbo Zhu 撰写。
@GitHub_Daily: 想搞懂大语言模型底层原理,大部分资料只介绍理论知识,或者只给源码,看完还是一头雾水。 偶然看到 EveryonesLLM 这个开源教程,手把手带我们在 Google Colab 上从零搭建一个完整的大语言模型,全程动手写代码。 整套教程分…
EveryonesLLM 是一个开源教程,提供29个章节的Colab笔记本,手把手教用户从零在Google Colab上搭建完整的大语言模型,包括预训练和指令微调,并支持中文。
@bo_wangbo:我们在内部随意训练了很多SOTA搜索模型,要不要时不时搞个小发布?
暗示即将以低调方式发布一个强大的开源多语言ColBERT搜索模型。
@lxfater: 网易有道开源了子曰4大模型,27B参数内,数理 SOTA 但真正让我觉得有趣的是它那个语音功能!! 克隆个声音不稀奇,ElevenLabs 早能做 但它们都有个通病,跨语种会串口音 拿你的中文声音去说日语,它带着一口中国腔,一听就是外国人…
网易有道开源了子曰4大模型,27B参数,数理性能达到SOTA;其语音功能支持3秒跨语言声音克隆,14种语言且无口音问题,同时开源了全场景智能体龙虾。