腾讯混元 Hy4 preview 开源:770B 参数、百万上下文

发布时间:2026/8/29 18:20:34

腾讯混元 Hy4 preview 开源:770B 参数、百万上下文
8 月 28 日腾讯混元发布并开源了新一代大语言模型 Hy4 preview总参数 770B、激活参数 49B、上下文长度 1M采用 Apache 2.0 许可证同步上线 HuggingFace、GitHub、ModelScope、Gitcode 等平台。按官方口径这个模型定位真实生产力场景代码、办公、科学类任务是其主攻方向。这次发布技术本质是什么先拆一下参数。770B 总参数、49B 激活参数是标准的 MoE混合专家架构——模型很大但每次推理只唤醒其中一小部分专家。这意味着它拥有大模型的容量推理成本却按 49B 的量级走这是 MoE 这几年成为开源旗舰标配的根本原因。真正值得注意的变化有两个上下文推到 1M。去年大家还在卷 128K、256K今年头部开源模型陆续摸到百万级Hy4 preview 是其中一档。1M 上下文意味着可以一次性塞进一本几百页的技术文档或者一整个代码仓库做分析。Apache 2.0 商用友好。权重和代码都可以自由商用、再发布这对想私有化部署、数据不出域的企业来说是最省事的一种许可证。没变的是什么呢它叫preview官方自己说明这是 Hy4 迭代的早期版本预训练和后训练都还有提升空间并且明确列了已知问题——复杂任务上容易长思考、有过度自我验证的倾向。也就是说这依然是一次先开源、再迭代的节奏和这两年国产开源旗舰的发布路径一致。据报道腾讯在生产力场景的盲测中Hy4 preview 的综合表现压过了 GLM-5.3 和 Kimi K3。这个数据是官方口径的盲测结果可以参考但别当定理。另外生态侧的配套也已经铺开燧原科技宣布针对 Hy4 preview 的百万级长上下文和 MoE 部署特性做了适配涉及算子融合、通信加速、低精度量化、PD 分离等据报道。这说明发布方考虑的不只是把权重扔上网而是连国产算力跑起来的路径一起给了——这对被卡脖子的企业来说比榜单名次更实际。对普通开发者意味着什么多了一个选项而且是个能免费商用的选项。以前接大模型 API 就那么几家现在开源生态里能打的多了一个价格和效果上多少会互相牵制。对做企业应用的人来说多一个可以私有化的候选议价空间就大一点。但对个人开发者最现实的建议是别想着自己部署它。770B 的模型哪怕只有 49B 激活FP8 量化版也要大几十 GB 显存起步单机基本没戏。官方在生产环境部署上推荐 vLLM 或 SGLang参考命令是这样的# 需要多机多卡集群如 8×H100 以上单机无法加载vllm serve tencent/Hy4-preview\--tensor-parallel-size8\--max-model-len131072就算--max-model-len 给到13万也远没到 1M 的宣传值——百万上下文的 KV cache 开销在显存上是天文数字实际生产里基本都要降档跑。所以对大多数人和大多数公司正确的打开方式不是自部署而是走 API模型已接入腾讯云 TokenHub 和 OpenRouter日常试用直接在元宝、ima、WorkBuddy、CodeBuddy 里就能切到。## 有哪些坑要留意- **1M 上下文不等于处处好用**。长上下文对显存和首 token 时延压力很大选型时按自己业务的实际输入长度去压测别按宣传上限设计。 - - **preview 版有已知问题**。官方都承认长思考、过度自我验证这会导致响应变慢、回答啰嗦甚至在小任务上绕圈子。上生产前拿自己的业务数据跑一遍比看榜单有用。 - - **盲测数据参考即可**。官方口径的对比测试选型时自己用典型case跑一轮比任何榜单都可靠。 - - **开源不等于免费跑**。Apache2.0免的是授权费算力成本一分不少。小团队先走 API 验证效果确认值了再谈自部署。 给一个简单粗暴的选型判断**对延迟不敏感、数据可以出域**比如内容生成、代码补全→ 直接走 API省心省钱**数据敏感、要私有化**金融、政务、医疗场景→ 再评估自部署这时候算力预算、运维能力、1M 上下文要不要全开都是要提前算的账。评估周期建议压到一到两周拿50个真实业务case跑一轮对比比看十篇测评都管用。 总结一下Hy4 preview 把大参数 百万上下文 宽松许可证三件套又卷高了一档但对绝大多数打工人来说它首先是一个可以白嫖试用的新模型其次才是一个部署选项。参数大不等于好用最后还得看业务场景认不认。你怎么看评论区聊聊。

相关新闻

LOGO上的字认不出来?LightOnOCR这类专治艺术字的模型是怎么做到的

LOGO上的字认不出来?LightOnOCR这类专治艺术字的模型是怎么做到的

2026/8/29 18:20:34

在多数工业字符识别场景里,传统 OCR 已经做得相当成熟,识别率动辄 99% 以上。可一旦遇到 LOGO、书法字、品牌定制字体,识别率就会断崖式下跌——明明是一行清清楚楚的汉字,模型却一个字都认不出来。 这不是 OCR 技术不行&#xff…

2026 AI 行业趋势洞察:九大趋势完整版(含判断与站位建议)

2026 AI 行业趋势洞察:九大趋势完整版(含判断与站位建议)

2026/8/29 18:20:34

📈 2026 AI 行业趋势洞察 九大趋势 完整版 含判断与站位建议 📑 目录 一 Harness 标准化 二 数字员工走向办事三 提示词→图工程四 本地化隐私优先五 全自动内容生产链六 Token 成本工程七 物联网Agent八 Agent 组织化九 溯源监管收紧附 工具…

Gemini Omni 1.1 Flash 发布:场景扩展上限 40 秒,AI 视频生成转向可控

Gemini Omni 1.1 Flash 发布:场景扩展上限 40 秒,AI 视频生成转向可控

2026/8/29 18:20:34

8 月 27 日,谷歌在 Google AI Studio 和 Gemini API 上正式推出 Gemini Omni 1.1 Flash,一个面向开发者的视频生成模型更新。这次的重点不是参数或画质口号,而是把"生成视频"往"导演视频"的方向推:场景扩展、…

T-DFNN:基于增量学习的入侵检测系统如何克服灾难性遗忘

T-DFNN:基于增量学习的入侵检测系统如何克服灾难性遗忘

2026/8/29 19:30:38

1. 项目概述:当入侵检测遇上“活到老学到老”的神经网络 最近在复现和消化一篇挺有意思的论文,标题是《T-DFNN: An Incremental Learning Algorithm for Intrusion Detection Systems》。简单来说,它解决的是网络安全领域一个经典的老大难问题…

STM32MP257 CM33核固件调试DDR写错误根因分析与解决方案

STM32MP257 CM33核固件调试DDR写错误根因分析与解决方案

2026/8/29 19:30:38

兄弟,今天聊一个实操里特别典型的坑:STM32MP257F-EV1板子在调试CM33核固件时,下载或者Debug阶段直接报"DDR Memory Write Error 0x80100000"。这个报错我前前后后折腾了两天,把ST的参考文档、CubeIDE的调试配置、甚至Cu…

YOLO驾驶员安全带与分心行为检测数据集实战指南

YOLO驾驶员安全带与分心行为检测数据集实战指南

2026/8/29 19:30:38

简介:YOLO目标检测是车载视觉系统的核心技术,尤其在小目标、强遮挡、低对比度场景下对模型鲁棒性提出严苛要求。驾驶员安全带检测属于典型工业级小目标识别任务,需结合物理尺寸校准、多形态电话标签(手持/耳挂/蓝牙)实…

STM32 HAL库工程移植实战:ADC与低功耗模式迁移要点解析

STM32 HAL库工程移植实战:ADC与低功耗模式迁移要点解析

2026/8/29 19:30:38

1. 项目概述:从零开始理解HAL工程移植的核心脉络最近在整理一个基于STM32的便携式数据采集设备项目,其中涉及将早期标准库工程迁移到HAL库。这个过程远比想象中复杂,尤其是在处理数模转换、低功耗待机唤醒这类对时序和硬件状态敏感的功能时&a…

仿网易云音乐静态页:纯CSS实现高分前端教学范本

仿网易云音乐静态页:纯CSS实现高分前端教学范本

2026/8/29 19:30:38

简介:静态网页是Web开发的基石概念,其核心在于HTML语义化结构、CSS布局原理与视觉表现力的深度协同。理解盒模型、选择器优先级、Flex/Grid布局机制,是掌握现代前端工程实践的前提。本文以高分‘仿网易云音乐’静态项目为案例,解析…

LLM调用日志规范:字段设计、成本核算与可观测实践

LLM调用日志规范:字段设计、成本核算与可观测实践

2026/8/29 19:20:38

这次我们来聊一个 LLM 工程落地过程中很容易被忽略,但排查问题、核算成本时又绕不开的问题: LLM 调用应该记录什么? 模型名、提示词、返回内容、token 用量、响应耗时、失败原因、链路 ID……不同团队各记各的,字段经常对不上。…

[光学原理与应用-521]:对光的错误理解与纠偏

[光学原理与应用-521]:对光的错误理解与纠偏

2026/8/27 11:10:02

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

SIP通话转接原理与REFER方法实战解析

SIP通话转接原理与REFER方法实战解析

2026/8/29 10:22:10

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

2026/8/28 7:34:42

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

四款热门降AI工具测评:研究生和本科生怎么选?

四款热门降AI工具测评:研究生和本科生怎么选?

2026/8/29 0:09:39

马上要交论文了,最近真的被论文ai率折磨的够呛。 明明查重都没问题了,但是ai率就是居高不下,崩溃了,明明都是我自己写的,天杀的,明明都是我亲生的啊 改来改去,终于给我搞出一套完美的降ai方案…

论文降AI率免费攻略:自查、提示词与工具推荐

论文降AI率免费攻略:自查、提示词与工具推荐

2026/8/29 0:09:39

马上要交论文了,最近真的被论文ai率折磨的够呛。 明明查重都没问题了,但是ai率就是居高不下,崩溃了,明明都是我自己写的,天杀的,明明都是我亲生的啊 改来改去,终于给我搞出一套完美的降ai方案…

北京GEO优化服务商推荐:预算型企业如何选北京GEO优化服务商?

北京GEO优化服务商推荐:预算型企业如何选北京GEO优化服务商?

2026/8/29 0:09:39

前言:预算有限的企业更关心投入能否形成可持续的品牌资产。评估北京GEO优化服务商时,不能只比较单篇内容或单月报价,还要看是否能够把问题词、官网、信源和监测串成完整链路。本期重点放在预算配置、试点范围和交付边界,帮助企业先…

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

2026/8/28 7:35:26

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…

导师推荐!2026最新AI论文工具测评与实用推荐

导师推荐!2026最新AI论文工具测评与实用推荐

2026/8/28 7:34:51

2026年真正好用的AI论文工具,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

告别游戏崩溃:XCOM 2模组管理器的智能革命

告别游戏崩溃:XCOM 2模组管理器的智能革命

2026/8/28 7:34:35

告别游戏崩溃:XCOM 2模组管理器的智能革命 【免费下载链接】xcom2-launcher The Alternative Mod Launcher (AML) is a replacement for the default game launchers from XCOM 2 and XCOM Chimera Squad. 项目地址: https://gitcode.com/gh_mirrors/xc/xcom2-lau…