DC娱乐网

腾讯的Hy3 这次,算是上桌了吗?

Hy3 正式发布后,最近讨论度不低。业界普遍提到它是 295B 参数规模,但从实际表现看,能力已经开始接近甚至超过部分一

Hy3 正式发布后,最近讨论度不低。

业界普遍提到它是 295B 参数规模,但从实际表现看,能力已经开始接近甚至超过部分一线模型。尤其是在推理、智能体、长上下文等任务上,进步比较明显。

我又拿之前常用的例子做了一次测试。

提示词是:

帮写一个 Html 页面,模拟太阳系 8 大行星绕太阳转。要有轨道,以及行星运转动画,地球轨道加上月亮。

第一次生成的效果已经不错。

页面结构、行星运动、月亮绕地球转,这些关键点基本都做出来了。放在以前,这类任务经常会出现动画错位、轨道混乱、月亮不跟随地球等问题。

不过它也不是完全没问题。

第一次生成时,行星轨道仍然偏圆,没有体现出真实轨道的椭圆感。

于是我继续补了一句:

行星轨道应该是椭圆形。

这次改得很快,而且方向是对的。

它没有推倒重写,也没有把页面改乱,而是在原有基础上把轨道形态调整了出来。这个体验很重要,因为写代码类任务里,模型能不能“听懂修改意见”,往往比第一次生成多漂亮更关键。

我最明显的感受是:这次 Hy3 的代码理解和修改能力,比豆包 Seed 2.1 更强一些。

当然,这只是一个小样本测试,不能代表所有场景。但从这类前端生成任务看,Hy3 的表现已经不是“能用”,而是有明显竞争力了。

再看价格,优势更直接。

旗舰模型

输入(元/百万 tokens)

输出(元/百万 tokens)

备注

Hy3

1

4

缓存命中 0.25 元

MiniMax M2.7

2.1

8.4

DeepSeek V4 Pro(非高峰)

3

6

有峰谷定价

DeepSeek V4 Pro(高峰)

6

12

高峰时段翻倍

豆包 Seed 2.1 Turbo

3

15

Qwen3.7-Max(618 折扣)

6

18

618 限时 5 折

豆包 Seed 2.1 Pro

6

30

Qwen3.7-Max(原价)

12

36

618 结束后恢复

GLM-5.2

8

28

缓存 2 元

Kimi K2.6

4

16

单看能力,Hy3 已经值得认真测试。

再叠加价格,它的竞争力就更明显了:输入 1 元、输出 4 元,在旗舰模型里属于非常有杀伤力的定价。

所以我的判断是:

Hy3 还不能简单说已经全面超过所有一线模型,但它已经不再只是“性价比模型”了。

它有可用的能力,有足够低的价格,也有继续进入主流开发和智能体场景的潜力。

如果用一句话总结:

Hy3 这次,确实可以说上桌了。