DC娱乐网

#互联网技术[超话]##DeepSeek计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。# DeepSeek计划9月10日前后推出V4.1 Flash,并把现有V4 Pro请求临时路由到新模型、按Flash低价计费,这套组合拳的信号很明确:它不想再让“Pro=贵、Flash=凑合”的二分法继续存在,而是要用轻量档把速度、多模态 ​

互联网技术DeepSeek计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。 DeepSeek计划9月10日前后推出V4.1 Flash,并把现有V4 Pro请求临时路由到新模型、按Flash低价计费,这套组合拳的信号很明确:它不想再让“Pro=贵、Flash=凑合”的二分法继续存在,而是要用轻量档把速度、多模态和成本一次打穿。

从已披露信息看,V4.1 Flash的看点不在“又大又全”,而在“更便宜还能干重活”:官方称性能、费用、速度、总用时全面超过V4 Pro;新架构、原生多模态,内测反馈输出约280—400 token/秒,图文/截图/表格理解不再靠外挂视觉模块;9月10日12点起Flash重新计价,闲时缓存命中输入0.02元/百万token、未命中1元、输出4元,高峰翻倍。 对客服、知识库、代码生成、报表解析、Agent串联这类高并发、长前缀、反复调用的场景,这比单纯追参数实用得多。

但评论要留半句冷话。厂商说“全面超越Pro”,通常指内部/外部选定基准下的综合账,不等于所有难任务都平替:超长文档推理、复杂数学、强工具规划、医学/法律等高风险问答,仍要看正式版公开评测而非内测体感。把Pro流量自动切到Flash是好事——用户省成本、迁移零改动;也是风险——若路由后在某些任务上质量回退,企业侧要有灰度、回滚和人工抽检。多模态更快更便宜后,OCR误读、图表幻觉、图片隐私、缓存复用带来的上下文泄露,也会跟着被放大。

更大的行业含义是,大模型竞争正在从“谁榜高分”转向“谁把可用智能的边际成本压下来”。Flash化、峰谷计价、原生多模态、自动路由,本质都是把AI从demo预算拉到生产预算。对开发者是利好,对闭源高价API是压力;但对所有厂商也是提醒——降价不是终点,稳定、可审计、可降级,才决定模型能不能真正进业务系统。