腾讯发布Hy4开源模型,770B总参/49B激活,100万token上下文窗口,比7月Hy3(295B/21B/256k)大幅升级,支持high/no_think两种推理模式。
8 月 29 日,Simon Willison 的链接博客
腾讯今日发布了新型开源文本模型 Hy4 Preview(无视觉能力):总计 7700 亿参数、490 亿活跃参数、100 万 token 上下文窗口,在 Hugging Face 上大小为 1.56TB。
相比腾讯 7 月发布的上一代 Hy3(2950 亿参数、210 亿活跃参数、256,000 上下文、大小 598GB),这是一次幅度可观的升级。
我最近开始使用模型的 chat template 来更好地理解其能力。下面是 Hugging Face 上 Hy4 的 chat_template.jinja,其中包含这样一段:
{%- if not reasoning_effort is defined %}
{%- set reasoning_effort = 'high' %}
{%- elif reasoning_effort not in ['high', 'no_think'] %}
{%- if reasoning_effort is none %}
{{- raise_exception('reasoning_effort error : None, should be no_think/high') }}
{%- else %}
{{- raise_exception('reasoning_effort error : ' + reasoning_effort + ', should be no_think/high') }}
{%- endif %}
{%- endif %}
看起来推理强度只有两个级别:"high"(默认)和"no_think"(禁用推理)。
我通过 OpenRouter 用默认的高推理强度测试了"Generate an SVG of a pelican riding a bicycle"这个提示词,得到了以下结果:

引用其推理过程:
[...] 要不要加个头盔?可以提升骑行主题,但可能遮住头部。或许加个小骑行帽或头盔?用户没要求;可以加个红色头盔吗?可能会很可爱。但鹈鹕有大嘴,头盔可能会遮住。也许不加更好。
要不要加墨镜?不了。
很有意思的是,推理痕迹使用了略微截断的英文,大概是因为对于隐藏推理文本而言,完美的语法既不实用也不够 token 高效。
概念完整性与代码行数统计 - 2026 年 8 月 19 日
Qwen 3.8 27B 很出色,但它默认会过度思考问题 - 2026 年 8 月 16 日
现在我们有了 OpenAI 意外攻击 Hugging Face 的时间线 - 2026 年 8 月 7 日
这是 Simon Willison 的链接帖,发布于 2026 年 8 月 29 日。
每月赞助 $10,即可收到当月最重要 LLM 动态的精选邮件摘要。
付费让我少给你发邮件!