welm

标签

Cards List
#welm

@Fenng: 微信 WeLM 团队的这篇论文至少透露了两种模型规模:80B 和 617B。每种规模分别包含普通版与 HD4 版,即 WeLM-80B、WeLM-HD4-80B、WeLM-617B 和 WeLM-HD4-617B。 其中,WeLM-617…

X AI KOLs Timeline · 2026-07-12 缓存

微信WeLM团队发表论文,介绍Hidden Decoding方法,在不增加Transformer主干参数的情况下通过隐藏流扩展计算,训练出WeLM-HD4-80B和WeLM-HD4-617B MoE模型,在多项基准上超越自回归基线。

0 人收藏 0 人点赞
#welm

@Fenng: 看到自媒体写的这么一段儿「最新的第四代 WeLM-80B,总参数已经只有 800 亿了,激活 30 亿,激活率只有 3.75%。作为对比——国内极致成本性能的代表 DeepSeek-V4-Flash,总参数 2840 亿、激活 130 亿…

X AI KOLs Timeline · 2026-06-23 缓存

Fenng shares a self-media comparison between the fourth-generation WeLM-80B (80B total params, 3B activated, 3.75% activation rate) and DeepSeek-V4-Flash (284B total, 13B activated, 4.6% activation rate), with a humorous comment.

0 人收藏 0 人点赞
#welm

@Fenng: WeLM 是腾讯微信团队自研的闭源大模型,混元是腾讯的开源大模型,定位不同。既然是闭源大模型,也就不可能对外披露技术细节,也不可能去参与评测(评测不过是一种宣传手段),如果要关注,还是从产品体验上感知吧。

X AI KOLs Following · 2026-06-22

Fenng 解释了腾讯 WeLM(闭源大模型)与混元(开源大模型)的定位区别,指出闭源模型不会公开技术细节或参与评测,建议从产品体验了解。

0 人收藏 0 人点赞
#welm

@Fenng: 微信团队自研的 WeLM 大模型,应该已经进入了国产大模型第一梯队。

X AI KOLs Following · 2026-06-22

微信团队自研的WeLM大模型被认为已进入国产大模型第一梯队。

0 人收藏 0 人点赞
#welm

@Fenng: 微信的 AI Agent 已经来了,产品名字「小微」,主模型用的 WeLM,部分回答用 DeepSeek 兜底,已经开始灰度。

X AI KOLs Following · 2026-06-20

微信推出AI Agent产品「小微」,主模型使用WeLM,部分回答由DeepSeek兜底,已开始灰度测试。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈