large-model

标签

Cards List
#large-model

@andykonwinski: 我忍不住要一直关注这个。Marin团队正在训练史上最大的完全开放模型。535B参数(23B活跃…

X AI KOLs Timeline · 4天前 缓存

Marin团队正在训练最大的完全开放模型,拥有535B参数,通过实时跟踪和开放数据日志提供前所未有的透明度。

0 人收藏 0 人点赞
#large-model

Hy4 Preview 发布

Simon Willison's Blog · 2026-08-29 缓存

腾讯发布了 Hy4 Preview,这是一款开源纯文本大语言模型,总参数 7700 亿,活跃参数 490 亿,上下文窗口达百万 token,具有 'high' 和 'no_think' 努力级别的推理能力。

0 人收藏 0 人点赞
#large-model

@binghe: Office CLI 一定要安装啊。。。 你将打开新世界,大模型再配合上你本来有的 PPT ,或数据分析类的 Skill ,真是如虎添翼!

X AI KOLs Timeline · 2026-08-09 缓存

推荐安装 Office CLI,配合大模型和 PPT、数据分析类 Skill 可以大幅提升办公效率。

0 人收藏 0 人点赞
#large-model

@latkins:通知有点晚,但30分钟后我將在这里演讲。这是我Trinity Large演讲的更新版,还有一些预告……

X AI KOLs Timeline · 2026-08-05 缓存

Alatkins宣布在拉斯维加斯的AI4大会上发表一场临时演讲,内容涵盖Trinity Large演讲的更新版本,并预告了关于训练一个400B MoE模型至17T tokens而无损失尖峰的内容。

0 人收藏 0 人点赞
#large-model

@cline:Qwen3.8-Max 是阿里巴巴迄今最大的模型,参数达 2.4T,在 Terminal-Bench 上的基准测试成绩比 Fable 5 高出 2%……

X AI KOLs Following · 2026-08-03 缓存

阿里巴巴发布了其最大的模型 Qwen3.8-Max,参数规模达 2.4T,在 Terminal-Bench 上的成绩比 Fable 5 高出 2%,开放权重将于下周发布。

0 人收藏 0 人点赞
#large-model

Kimi K3 就像展窗里的 F1 赛车。

Reddit r/LocalLLaMA · 2026-07-27

Moonshot 发布了 Kimi K3,这是一个极其庞大的 AI 模型,即便在配备多块 RTX 6000 Blackwell GPU 的本地工作站上也无法原生运行,促使作者尝试通过破解或蒸馏的方式让它跑起来。

0 人收藏 0 人点赞
#large-model

世界最杰出的数学家本周获奖,随即宣布离开学术界加入OpenAI。这带来的冲击与我预想的不太一样。

Reddit r/artificial · 2026-07-27

菲尔兹奖得主Jacob Tsimerman宣布离开学术界,加入OpenAI的安全团队;同时,NVIDIA正在探讨为一座数据中心提供大规模融资,而开源模型Kimi K3(2.8万亿参数)也已发布。

0 人收藏 0 人点赞
#large-model

关于Kimi K3:其能力与相关不满(70分钟阅读)

TLDR AI · 2026-07-21 缓存

Kimi K3是Moonshot AI推出的2.8T参数开放模型,基准测试表现强劲,但可能过度优化,且落后顶级闭源模型数月。它从Claude蒸馏而来,其发布可能先于IPO。

0 人收藏 0 人点赞
#large-model

Inkling

Product Hunt · 2026-07-20

Inkling 是一个开放权重的 975B 多模态 AI 模型,专为微调而设计。

0 人收藏 0 人点赞
#large-model

@siantgirl: 因恶意攻击大模型被字节开除的赔800w的实习生田柯宇已经拿到上亿融资了,柳暗花明,哈哈哈哈哈哈哈

X AI KOLs Timeline · 2026-07-13

曾因恶意攻击大模型被字节跳动开除并赔付800万的实习生田柯宇,现已获得上亿融资,实现了柳暗花明的转变。

0 人收藏 0 人点赞
#large-model

@seclink: 自媒体是挺恶意的,譬如下面这篇主题为《年薪600万抢AI博士,读书不如“进厂炼丹”?》,小编歪曲事实博眼球 ... 7月6日,据《中国新闻周刊》报道, 今年毕业季尾声,清华大学计算机系NLP实验室公布了一份毕业生去向统计, 14名毕业生中…

X AI KOLs Following · 2026-07-08 缓存

清华大学NLP实验室毕业生去向统计显示,大模型方向博士年薪可达600万以上,硕士百万以上,引发对自媒体歪曲报道的批评。

0 人收藏 0 人点赞
#large-model

@seclink: MiMo-V2.5-Pro-UltraSpeed 超快 , 大模型注意力机制差异可视化。

X AI KOLs Following · 2026-07-03 缓存

MiMo-V2.5-Pro-UltraSpeed 是一个用于可视化大模型注意力机制差异的工具,主打超快速度。

0 人收藏 0 人点赞
#large-model

@seclink: MiMo-V2.5-Pro-UltraSpeed 超快 , 大模型训练 pipeline 管线.

X AI KOLs Following · 2026-07-03 缓存

MiMo-V2.5-Pro-UltraSpeed 是一个超快的大模型训练 pipeline 管线。

0 人收藏 0 人点赞
#large-model

@MaxForAI: Meta 的新模型Muse Spark即将推出。 新模型根据Alex Wang的说法在编码和代理能力方面有重大改进,以更具竞争力地与其他领先模型竞争。 新模型会是一个非常大的模型

X AI KOLs Timeline · 2026-07-03 缓存

Meta即将推出新模型Muse Spark,据Alexandr Wang称,该模型在编码和代理能力方面有重大改进,旨在与其他领先模型竞争,且模型规模非常大。

0 人收藏 0 人点赞
#large-model

V100四卡AI大模型,Tesla 128G服务器

Reddit r/LocalLLaMA · 2026-06-23

宣布一款服务器配置,搭载4块Nvidia V100 GPU和128GB Tesla内存,面向AI大模型工作负载。

0 人收藏 0 人点赞
#large-model

@seclink: 蚂蚁集团最近上架了好多 大模型 + 健康 的岗位,有校招也有社招。 正在找工作的朋友可以关注一下蚂蚁的工作机会看一看。

X AI KOLs Following · 2026-06-09

蚂蚁集团近期发布了大量涉及大模型和健康领域的招聘岗位,包括校园招聘和社会招聘,为求职者提供了机会。

0 人收藏 0 人点赞
#large-model

@seclink: 冷知识: 目前多模态大模型创业的具体落地方向通常有如下方向,如果都不是你感兴趣的话,还是别赶时髦,乖乖回去学AI coding吧 : 1. 游戏 AI NPC / 智能体中间件(如端云协同的 OmniNPC,赋能 3D 角色交互与情感叙事…

X AI KOLs Timeline · 2026-06-03 缓存

总结了当前多模态大模型创业的几个主要落地方向,包括游戏AI NPC、企业级多模态Agent、内容生成、具身智能和视觉代码助手等。

0 人收藏 0 人点赞
#large-model

@garrytan: Thinking Machines令人印象深刻。今天下午我只用了几个小时就微调了自己的Qwen3.5-397B模型。快速可用…

X AI KOLs Following · 2026-05-24 缓存

Garry Tan发推文称,他使用Thinking Machines在几个小时内微调了自己的Qwen3.5-397B模型,称赞其速度和可用性,用于多模态个人AI。

0 人收藏 0 人点赞
#large-model

@turingbook: 其实早就是常态了。2023年在光年之外,我周围很多同事都是之前某个公司的CTO、快手十几号员工。今天还和一个刚去某大模型大厂的老朋友吃饭,他卖了公司去实习了一段时间,刚转正,开始组团队了。

X AI KOLs Timeline · 2026-05-19 缓存

一条关于AI大模型行业人才流动的观察:许多前CTO和快手早期员工加入相关公司,以及创业者卖公司后实习转正组团队的现象。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈