腾讯将 Hy4-preview 从 1.5TB 压缩至约 200GB GGUF,并保持约 98% 的性能。
摘要
腾讯已将 Hy4-preview 模型从 1.5TB 压缩至约 200GB GGUF 格式,同时保持了约 98% 的性能。
暂无内容
相似文章
腾讯 Hy4 预览版完整基准测试
腾讯预览了其 Hy4 模型的完整基准测试,提供了详细的性能评估和能力见解。
腾讯/Hy4-preview 770B-A49B 模型权重发布
腾讯发布Hy4-preview,这是一款新的旗舰AI模型,采用混合专家架构,总参数为770B,每个token激活49B参数,具备如Gated DeepSeek Sparse Attention和identity Hyper-Connections等先进技术。
Hy4 预览版
Tencent 的 Hy4 Preview 是一款 770B 开源 MoE 模型,具有 1M 上下文长度,旨在自主处理编码、游戏开发和复杂文档分析。
@Xudong07452910: 一个 295B 参数的旗舰大模型,现在单张 96GB 推理显卡就能跑,而且解码速度还提升了 50%。 腾讯混元团队为 Hy3(295B 参数)推出量化版本。1bit 版本(IQ1_M)把权重从 598GB 压缩到 85.5GB,缩小 6.…
腾讯混元团队为295B参数的Hy3大模型推出量化版本,1bit版本可将权重压缩至85.5GB,使单张96GB推理显卡即可部署,解码速度提升约50%,并开源GGUF格式,兼容llama.cpp生态。
@atomic_chat_hq: 在本地运行1位Hy3,速度比其API快2.2倍,质量相同!我们为两个模型分配了相同的任务并比较…
腾讯的Hy3 295B模型现已提供1位和4位GGUF格式,相比云端API,本地推理速度提升2.2倍,同时保持质量,如在4块RTX 5090显卡(128GB显存)上所展示的。