腾讯混元Hy4 preview开源:770B参数、百万上下文,稳居开源第一梯队

AI资讯2周前发布 全启星小编
1,045 0

腾讯混元Hy4 preview开源:770B参数、百万上下文,稳居开源第一梯队

近日,腾讯混元系列大模型迎来重大进展——**Hy4 preview**正式开源。该模型以**770B(7700亿)参数**、**100万token上下文窗口**的规格,一举跻身全球开源大模型的最前列。这不仅标志着腾讯在基础模型研发上的技术积累进入新阶段,也为整个开源社区提供了又一个极具竞争力的基座选择。

技术架构与核心亮点

Hy4 preview采用**MoE(混合专家)架构**,在保持770B总参数的同时,通过稀疏激活机制降低推理成本。其核心创新点在于**百万级上下文支持**:通过改进的旋转位置编码(RoPE)与分段式注意力计算,模型能够在不显著增加内存开销的前提下,实现对超长文档、代码库甚至多轮对话历史的完整建模。这一能力在开源模型中极为罕见,此前仅有Claude、Gemini等闭源模型达到类似水平。

性能与开源生态定位

在多项基准测试中,Hy4 preview在数学推理(如GSM8K、MATH)、代码生成(HumanEval、MBPP)以及长文本理解(LongBench、L-Eval)上均表现出色,部分指标接近甚至超越Llama 3.1 405B。与同尺寸社区模型(如Qwen2.5 72B、Falcon 180B)相比,Hy4 preview在**长上下文场景**下的优势尤为突出,例如在百万token级别的“大海捞针”测试中保持了接近100%的准确率。

行业影响与未来展望

腾讯此次开源Hy4 preview,既是技术实力的展示,也是其“开源共建”策略的深化。模型采用Apache 2.0协议,允许商用和二次开发,预计将吸引大量研究者和开发者基于其进行微调、蒸馏与垂直领域应用。当前,开源大模型第一梯队正由Llama、Qwen、Mistral等系列主导,而Hy4 preview的加入,凭借**参数规模**和**上下文长度**的双重优势,有望在金融、法律、医疗等需要处理超长文档的行业率先落地。

当然,770B的模型对部署资源提出了极高要求,如何通过量化、剪枝等手段降低门槛,将是腾讯后续需要重点解决的问题。总体而言,Hy4 preview的开源不仅丰富了生态,更推动了大模型“长上下文能力”的普惠化进程。

相关文章