Hy3 正式发布后,最近讨论度不低。
业界普遍提到它是 295B 参数规模,但从实际表现看,能力已经开始接近甚至超过部分一线模型。尤其是在推理、智能体、长上下文等任务上,进步比较明显。
我又拿之前常用的例子做了一次测试。
提示词是:
帮写一个 Html 页面,模拟太阳系 8 大行星绕太阳转。要有轨道,以及行星运转动画,地球轨道加上月亮。
第一次生成的效果已经不错。
页面结构、行星运动、月亮绕地球转,这些关键点基本都做出来了。放在以前,这类任务经常会出现动画错位、轨道混乱、月亮不跟随地球等问题。

不过它也不是完全没问题。
第一次生成时,行星轨道仍然偏圆,没有体现出真实轨道的椭圆感。
于是我继续补了一句:
行星轨道应该是椭圆形。
这次改得很快,而且方向是对的。
它没有推倒重写,也没有把页面改乱,而是在原有基础上把轨道形态调整了出来。这个体验很重要,因为写代码类任务里,模型能不能“听懂修改意见”,往往比第一次生成多漂亮更关键。

我最明显的感受是:这次 Hy3 的代码理解和修改能力,比豆包 Seed 2.1 更强一些。
当然,这只是一个小样本测试,不能代表所有场景。但从这类前端生成任务看,Hy3 的表现已经不是“能用”,而是有明显竞争力了。
再看价格,优势更直接。
旗舰模型
输入(元/百万 tokens)
输出(元/百万 tokens)
备注
Hy3
1
4
缓存命中 0.25 元
MiniMax M2.7
2.1
8.4
—
DeepSeek V4 Pro(非高峰)
3
6
有峰谷定价
DeepSeek V4 Pro(高峰)
6
12
高峰时段翻倍
豆包 Seed 2.1 Turbo
3
15
—
Qwen3.7-Max(618 折扣)
6
18
618 限时 5 折
豆包 Seed 2.1 Pro
6
30
—
Qwen3.7-Max(原价)
12
36
618 结束后恢复
GLM-5.2
8
28
缓存 2 元
Kimi K2.6
4
16
—
单看能力,Hy3 已经值得认真测试。
再叠加价格,它的竞争力就更明显了:输入 1 元、输出 4 元,在旗舰模型里属于非常有杀伤力的定价。
所以我的判断是:
Hy3 还不能简单说已经全面超过所有一线模型,但它已经不再只是“性价比模型”了。
它有可用的能力,有足够低的价格,也有继续进入主流开发和智能体场景的潜力。
如果用一句话总结:
Hy3 这次,确实可以说上桌了。