首页 / 工具与工作流

腾讯开源 Hy4 preview:770B 生产力旗舰,法律场景怎么用、怎么采

2026 年 8 月 28 日,腾讯发布并开源新一代混元旗舰模型 Hy4 preview(腾讯混元 Hy4 预览版)。官方把它写成面向真实生产力任务的开源旗舰,代码、办公分析、科学研究是公开材料里反复出现的场景;权重、产品入口和云端 API 也一并放出。

对法律科技观察,值得记录的不是“参数又大了一圈”,而是模型说明、开源权重、产品内嵌与云上调用可能对应不同主体与不同合同安排。下面按可核对事实、规格与架构、法律场景用法分开写。

发布与开源

据腾讯英文新闻稿与混元开源仓库,Hy4 preview 于 2026 年 8 月 28 日发布并开源。模型以 Apache 2.0 许可提供 Instruct 权重及 FP8 量化版本,托管于 Hugging Face、ModelScope、GitCode、CNB 等平台。官方研究页与 GitHub 仓库(Tencent-Hunyuan/Hy4-preview)对规格表述一致。

腾讯称,Hy4 preview 在模型规模、上下文长度与训练数据量上较前代显著扩展,预训练与后训练共同支撑其进入开源模型第一梯队。官方同时标明:这是 Hy4 的早期预览版本,预训练与后训练仍有提升空间;已知问题包括复杂任务上的长思考与过度自我验证,团队将继续迭代。

产品与 API

  • 产品侧:WorkBuddy、CodeBuddy(国内/国际)、元宝(Yuanbao)、ima 等腾讯产品同步首发或接入。
  • 免费策略:Hy4 preview 在 WorkBuddy、CodeBuddy 上线后前两周免费;Hy3 在上述平台的免费期延长至 2026 年 9 月 30 日
  • API 侧:可通过腾讯云 TokenHub 与 OpenRouter 接入;亦支持自建部署(官方推荐 vLLM、SGLang 等推理栈)。

公开报道还提到腾讯云参考计价(人民币 / 百万 tokens 量级:输入约 6 元、输出约 18 元、缓存命中约 0.3 元),国际通道价格另计。具体以腾讯云与 OpenRouter 实时价目为准。

官方强调的能力场景

腾讯将 Hy4 preview 写成“为生产力而生”,并列举与内部专家共建数据的领域:软件工程、游戏、金融、安全等。公开材料中的任务画像包括:

  • 软件工程:长程开发中的理解、规划、调试与验证;前端视觉与交互质量。
  • 办公与分析:复杂办公环境理解、金融分析、数据分析与跨文件协作;覆盖从信息处理到文档、表格、演示文稿交付。
  • 游戏开发:自然语言生成可玩原型,并与主流引擎协作。
  • 科学研究:复杂科研问题的理解与推理,涵盖 AI 研发、分子动力学、凝聚态物理、基础数学等。

内部盲测方面,腾讯组织 163 名专家、针对 203 个真实工程任务打分:Hy4 preview 均分 2.99 / 4,略高于 GLM-5.3(2.92)与 Kimi K3(2.94)。这是腾讯内部评测,外部独立复现仍有待观察。

官方还称,Hy4 preview 更深度参与了训练方法、数据策略、评测框架与底层算子的自动化优化,并在推理系统瓶颈上做过多轮改进。这类表述属于厂商技术叙事,宜与可复现基准、真实业务验收分开看。

核心规格

根据开源 README(主干参数,不含 MTP 层)与官方新闻稿,关键规格如下:

  • 架构:混合专家 MoE,生产力向旗舰。
  • 总参数770B,显著大于 Hy3 preview 公开的约 295B 量级。
  • 每 token 激活参数49B,Hy3 preview 公开约 21B 激活。
  • 层数:78,第 1 层标准 FFN,其余 77 层 MoE。
  • 专家结构:每层 256 路由专家 + 1 共享专家,每 token 激活 top-8 路由专家 + 共享专家。
  • 隐藏维度:6144。
  • 注意力:Gated DSA(稀疏注意力),配合 IndexCache 跨层复用稀疏索引。
  • 注意力头:64,Query 压缩 2048 / KV 压缩 512。
  • 残差通路:iHC,4 条残差流,用于扩展层间信息通路。
  • 上下文1M tokens,公开材料称远超 Hy3 的 256K。
  • 词表:120832。
  • MTP:原生 1 层,约 10B 总参 / 0.7B 激活,用于投机解码、加速推理。
  • 许可:Apache 2.0,含 FP8 量化权重。

采购与技术尽调时,比“770B”更要紧的是三点:

  • 总参大、激活中等——算力账单由激活路径、上下文长度与并发共同决定,不能只看总参数。
  • 1M 上下文——理论上可一次装入多份长合同、卷宗与制度汇编;有效利用仍取决于检索、分段、引用回溯与费用控制,而不取决于窗口上限本身。
  • 开源 + 多入口——权重可自托管,也可走腾讯云 / OpenRouter / 产品内嵌;同一模型名可能对应不同数据处理主体与日志落点。

架构选择对法律工作流的含义

MoE 与成本结构。 每 token 只激活约 49B,有利于在旗舰能力与单位推理成本之间折中。律所或法务若自建,仍需按 FP8 权重、张量并行(官方示例常见 8 卡级配置)、投机解码(MTP)和峰值并发做容量规划;若走 API,应在合同附件中固定模型标识、区域、价目与变更通知义务。

长上下文与整卷一次喂入。 1M tokens 对尽调数据包、股权交易全文、诉讼材料汇编有吸引力。实务上更稳妥的验收标准通常是:关键条款能否稳定抽到字段、能否回到原文页码或段落、跨文件引用是否可追溯。窗口变长降低切分次数,并不自动降低幻觉与张冠李戴风险。

生产力向后训练。 官方强调与 CodeBuddy、WorkBuddy 及金融、工程专家共建。对法律团队,这意味着模型可能更擅长“跨文档整理—表格化—生成交付件”的办公链路,并不会自动具备管辖法、强制规范与证据规则上的可靠判断。产品叙事中的“金融分析”“跨文件协作”,可以落到合同台账、条款对照、事实时间线草稿,但输出仍需律师复核。

Agent 与工具调用。 部署文档提供 tool-call / reasoning parser 配置,面向代理式工作流。法律场景若接入检索库、文书模板、内部知识库,须在系统说明书中写清:工具白名单、禁止外传的数据类、人工确认节点,以及模型升级时的回归测试集(例如固定 NDA、股权回购、劳动争议样本)。

法律场景用法

结合公开能力画像,较匹配的试点包括:

  • 长材料预处理:多份合同、规章、往来邮件的结构化摘要、争议焦点列表、时间线草稿,输出定位为人工核对的底稿。
  • 条款对照与差异表:买方稿 / 卖方稿对照、模板偏离项清单(字段化输出便于进入台账)。
  • 办公交付链路:从材料包到备忘录大纲、表格、演示文稿骨架——贴近官方“文档—表格—PPT”生产力叙事。
  • 内部知识库问答(只读):制度、历史意见、标准条款库的检索增强问答;需隔离客户秘密与公共语料。
  • 工程化法务工具:与现有合同系统、对象存储、权限体系集成的草稿生成与校验脚本(偏 CodeBuddy 类工作流)。

不宜默认交给模型终局负责的事项包括:出具正式法律意见、无检索依据的法条适用、证据三性判断、监管报送材料的自动落款,以及任何“一次生成即对外生效”的文书。Hy4 preview 自承仍有长思考与过度自我验证问题,复杂合规任务更应限制自动循环次数,并保留人工中止权。

合规与采购要点

  • 模型本体 vs 推理入口:开源权重自托管、腾讯云 TokenHub、OpenRouter、元宝/ima/WorkBuddy 内嵌,主体与日志可能不同。
  • 数据分类:客户合同、身份信息、未公开交易信息是否出境、是否用于改进模型,需在协议中写死。
  • 版本钉扎:preview 会迭代;生产应记录模型 ID、量化版本(如 FP8)、调用日期与提示词哈希。
  • 输出责任:结构化字段可验收,法律正确性由执业人员确认;界面需避免“AI 已审核通过”类误导表述。
  • 开源许可:Apache 2.0 有利于二次开发,但商标、产品名与对客宣传仍须单独合规审查。
  • 生成式 AI 合规:面向境内公众的服务与纯内部应用,适用义务不同;内部试点也不能省略数据处理事实说明。

Hy4 preview 的事实面清楚:2026-08-28 发布并开源,770B 总参 / 49B 激活,1M 上下文,Apache 2.0,产品与 API 多入口,官方对标生产力与开源第一梯队。对法律场景,价值主要在长材料处理、跨文件协作和可字段化草稿,而非取代律师。决定其能否进真实卷宗的,仍是入口主体、数据边界、版本可追溯与人工复核是否写清——这些不会因为模型进入开源第一梯队就自动完成。

资料来源

从读到用

带走这份四步核对清单

  • 先界定任务与数据边界
  • 检查来源是否可定位
  • 设置人工复核与升级条件
  • 保留权限、版本和日志