DC娱乐网

Qwen3.8被14B小模型反超10分 一个 14B 的小模型,在长文本任务上把

Qwen3.8被14B小模型反超10分
一个 14B 的小模型,在长文本任务上把 27B 的 Qwen3.8 甩开了 10 分。

论文 arXiv:2609.31382 提出 H2S,思路很朴素:先划重点,再写摘要,最后才作答。在 128K 输入、4K 输出的同等预算下,H2S-14B 在七项长文本任务上均分 32.60,比 Qwen3.8-27B 高 10.17 分,是参评开源模型里的最好成绩。把输出预算从 16K 砍到 4K,它还能保住 97.1% 的表现,意味着同样的活,token 账单能省下一大截。训练数据 6647 条,平均上下文 43.9K token。要注意的是,测试集 H2S-Bench 是作者自己搭的。

自家考卷赢了 10 分,你信几成? Qwen 通义千问 长文本