Hy4 Preview 发布

Simon Willison's Blog 模型

摘要

腾讯发布了 Hy4 Preview,这是一款开源纯文本大语言模型,总参数 7700 亿,活跃参数 490 亿,上下文窗口达百万 token,具有 'high' 和 'no_think' 努力级别的推理能力。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/08/30 03:32

# 介绍 Hy4 Preview 来源:https://simonwillison.net/2026/Aug/29/hy4/ 2026年8月29日 \- 链接博客 **介绍 Hy4 Preview (https://hy.tencent.ai/research/hy4-preview)**。今日,中国公司腾讯发布新的开源权重文本输入(无视觉功能)大语言模型:总参数770B,活跃参数49B,上下文窗口1M token,Hugging Face (https://huggingface.co/tencent/Hy4-preview) 上模型大小1.56TB。 这相比他们七月份推出的前代模型 Hy3 (https://huggingface.co/tencent/Hy3) 有显著增大,当时模型参数为295B,活跃参数21B,上下文长度256,000,大小598GB。 我最近开始使用模型聊天模板来更好地理解其功能。以下是 Hy4 在 Hugging Face 上的 chat_template.jinja (https://huggingface.co/tencent/Hy4-preview/blob/main/chat_template.jinja),包含以下部分: ``` {%- if not reasoning_effort is defined %} {%- set reasoning_effort = 'high' %} {%- elif reasoning_effort not in ['high', 'no_think'] %} {%- if reasoning_effort is none %} {{- raise_exception('reasoning_effort error : None, should be no_think/high') }} {%- else %} {{- raise_exception('reasoning_effort error : ' + reasoning_effort + ', should be no_think/high') }} {%- endif %} {%- endif %} ``` 看起来它只有两种推理努力等级:"high"(默认)和 "no_think"(禁用推理)。 我通过 OpenRouter (https://openrouter.ai/tencent/hy4-preview#apps) 使用默认的 high 推理等级,尝试了“生成一个鹈鹕骑自行车的 SVG”提示,并得到了这个结果 (https://tools.simonwillison.net/markdown-svg-renderer#url=https%3A%2F%2Fgist.github.com%2Fsimonw%2Fcb69816b3fb940f2782569a82a523af1): 扁平矢量卡通插图,一只白色鹈鹕,有着巨大的橙色喙,骑着一辆红色自行车向右行驶在灰色道路上,路中心有白色虚线标记,它橙色的蹼脚踩在踏板上,灰色尾羽在身后散开,背景是淡蓝色的天空,挂着一轮黄色的太阳、白色的云朵和水平的白色运动线条,暗示着速度。 引用其推理追踪: > \[\.\.\.\] 我们也许可以加个头盔?这可能强化骑行主题,但可能会遮挡头部。也许是个小骑行帽或头盔?用户没要求;可以加个红色头盔吗?可能会很可爱。但鹈鹕有大喙,头盔可能会遮挡。也许最好不加。也许加太阳镜?不。也许加水?不。 有趣的是,推理追踪使用了略微精简的英文,可能是因为完美的语法对于隐藏的推理文本而言并非必要,且不够节省 token。

相似文章

腾讯发布并开源Tencent Hy4预览版

Hacker News Top

腾讯发布了Tencent Hy4预览版,这是一个开源的大型语言模型,拥有7700亿参数和超过100万个token的上下文,专为编码、办公和科研等生产力任务设计。

Hy4 预览版

Product Hunt

Tencent 的 Hy4 Preview 是一款 770B 开源 MoE 模型,具有 1M 上下文长度,旨在自主处理编码、游戏开发和复杂文档分析。

腾讯/Hy4-preview 770B-A49B 模型权重发布

Reddit r/LocalLLaMA

腾讯发布Hy4-preview,这是一款新的旗舰AI模型,采用混合专家架构,总参数为770B,每个token激活49B参数,具备如Gated DeepSeek Sparse Attention和identity Hyper-Connections等先进技术。

HY-3 预览版

Reddit r/LocalLLaMA

腾讯发布 2950 亿参数的 MoE 模型 Hy3-preview,激活参数 210 亿,在 STEM 推理、指令遵循、编程与智能体任务上表现卓越。