腾讯发布并开源Tencent Hy4预览版

Hacker News Top 模型

摘要

腾讯发布了Tencent Hy4预览版,这是一个开源的大型语言模型,拥有7700亿参数和超过100万个token的上下文,专为编码、办公和科研等生产力任务设计。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/08/29 21:38

# 腾讯发布并开源腾讯混元Hy4 preview模型 来源:https://www.tencent.com/tencent-releases-and-open-sources-tencent-hy4-preview/ ***位列开源模型第一梯队,Hy4 preview专为真实生产力场景构建,在编码、办公及科研领域展现卓越性能*** 腾讯已发布并开源腾讯混元Hy4 preview——这款下一代大语言模型总参数达7700亿,激活参数490亿,上下文窗口超过100万tokens。该模型在编码、办公及科研等真实生产力任务中展现出卓越能力。 Hy4 preview现已作为开源模型发布,用户也可通过WorkBuddy、CodeBuddy及元宝、ima等腾讯产品在全球范围内使用。用户既可通过这些应用直接体验模型,也能通过腾讯云TokenHub和OpenRouter的API接入服务。 上线初期,Hy4 preview将在WorkBuddy和CodeBuddy上免费开放两周。两个平台对Hy3模型的免费访问也将延长至9月30日。 Hy4 preview在模型规模、上下文长度和训练数据量上实现了大幅提升,预训练与后训练技术的双重突破推动了整体智能水平的飞跃,使该模型跻身开源模型第一梯队。 混元团队持续与CodeBuddy、WorkBuddy等产品深度协同设计,针对生产力场景优化真实用户体验。在腾讯内部进行的盲评中(163位专家参与,评测203个工程任务),Hy4 preview获得平均2.99分(满分4.00),略优于GLM-5.3(2.92/4.00)和Kimi K3(2.94/4.00)。 为生产力场景而生的Hy4 preview,采用与腾讯软件工程、游戏、金融、安全等领域专家共同创建的高质量训练数据,并与WorkBuddy等产品进行深度协同设计开发。这推动了该模型在各类真实生产力任务中实现显著提升。 在软件工程领域,Hy4 preview为长上下文开发任务提供更强的理解、规划、调试和验证能力,同时提升了前端开发的视觉质量和交互体验。 在办公生产力与分析场景中,模型展现出对复杂工作环境更强的理解能力,并增强了金融分析功能。针对数据分析和跨文档协作场景的优化,支持从信息处理到创建文档、表格和演示文稿的全流程。 在游戏开发中,Hy4 preview能通过单句自然语言指令生成可玩原型,并与游戏引擎高效协作。开发者可通过多轮交互继续完善复杂游戏项目。 在科学研究领域,Hy4 preview在理解、推理解答复杂研究难题方面展现更强能力,在AI研发、分子动力学模拟、凝聚态物理和基础数学等领域均有显著提升。 值得注意的是,Hy4 preview首次参与了自身开发过程的自动化优化,涵盖训练方法、数据策略、评估框架和底层算子优化。该模型自主提出方案、运行实验、基于结果迭代,生成的代码、日志和反馈被纳入后续探索循环,形成了早期递归自我改进机制。 Hy4 preview还自主分析了推理系统的瓶颈,并对算子融合、通信优化等领域进行多轮优化。与基准相比,端到端吞吐量提升31.8%,在不同上下文长度和并发层级下均保持稳定增益,展现了模型自主优化推理基础设施的能力。 Hy4 preview持续提供高成本效益,助力先进AI技术更广泛普及。API定价为:输入每百万tokens 0.834美元,输出每百万tokens 2.501美元,缓存命中每百万tokens 0.042美元。 通过"预览优先、正式发布跟进"的策略,混元团队将持续将真实反馈融入研发流程,使模型在解决现实问题的过程中不断进化。Hy4系列下一批模型预计即将推出。

相似文章

Hy4 预览版

Product Hunt

Tencent 的 Hy4 Preview 是一款 770B 开源 MoE 模型,具有 1M 上下文长度,旨在自主处理编码、游戏开发和复杂文档分析。

腾讯/Hy4-preview 770B-A49B 模型权重发布

Reddit r/LocalLLaMA

腾讯发布Hy4-preview,这是一款新的旗舰AI模型,采用混合专家架构,总参数为770B,每个token激活49B参数,具备如Gated DeepSeek Sparse Attention和identity Hyper-Connections等先进技术。

HY-3 预览版

Reddit r/LocalLLaMA

腾讯发布 2950 亿参数的 MoE 模型 Hy3-preview,激活参数 210 亿,在 STEM 推理、指令遵循、编程与智能体任务上表现卓越。