DC娱乐网

DeepSeek V4.1内测,模型名里写着过期日

DeepSeek悄悄放出来一个东西。它是V4.1 Flash的内部内测。你不会在模型列表里自动看到它——得手动把模型名填
DeepSeek悄悄放出来一个东西。它是V4.1 Flash的内部内测。你不会在模型列表里自动看到它——得手动把模型名填成deepseek-v4.1-flash-expires-on-0910。光看这个名字就知道两件事:这是V4.1,而且它9月10日就过期。
V4.1 Flash是什么按DeepSeek API平台的公告,V4.1 Flash换用了新的模型架构,支持原生多模态,能力更强、速度更快、成本更低。base_url不用动,价格沿用V4 Flash那一档,账号级限并发20。

DeepSeek V4 模型家族规格(官方API文档,V4-Pro 1.6T/49B激活、V4-Flash 284B/13B激活,均为1M上下文)
有个细节值得多看一眼。7月31日V4 Flash正式版发布时,官方变更日志里明写它和Preview版"保持相同的模型架构与规模,只是重新post-train"。那么这次V4.1说的"新架构",就不是在旧底座上再调一遍,而是结构上动了一刀。
再看"原生多模态"这五个字。8月21日DeepSeek放的是一个独立的多模态模型V4-Flash-Vision-Exp,是挂在Flash旁边的一条支线,官方口径是"纯文本能力和V4-Flash持平、多模态Agent接近Opus-4.8"。而这次V4.1把多模态说成是"原生"的,意思是视觉能力直接长进主架构里,不用再切一个Exp分支去接。从"外挂一条视觉支路"到"主模型天生会看图",这是两条不同的路。后者的差别在于:多模态和文本、Agent推理被放在同一个底座里一起做,上限更高,代价是训练和推理的复杂度都上来了。
"过期"是DeepSeek的习惯把过期日写进模型名,对DeepSeek不算头一回。去年12月它放V3.2-Speciale时,端点名就是v3.2_speciale_expires_on_20251215。这是一种"限时预览"的做法:正式GA之前,先把下一代的东西放到真实用户手里跑一段时间,收反馈,再决定收回还是转正。V4.1卡在9月10日,留给人的窗口基本就两天。它其实是在催你用得快一点、熟悉得快一点。
迭代节奏把V4家族的时间线摆开看:V4 Preview是4月24日,V4 Flash正式是7月31日,V4 Pro GA是8月13日,V4 Flash Vision-Exp是8月21日,这次V4.1内测是9月8日。正式版差不多两到三周一档,V4.1是在这套节奏上又往前推了一格。Flash这一档是DeepSeek的走量层:参数小、响应快、便宜,接的是大头的日常请求。让新架构加原生多模态落在Flash而不是Pro,等于把前沿级别的多模态往下压到廉价档,价格还停在V4 Flash——这条成本楔子一直没松手。
顺着这条线还能推一步:8月21日那个独立的V4-Flash-Vision-Exp,原本是把视觉当成一条外挂的实验支线在做。一旦V4.1把多模态做成了原生,Vision-Exp这条支线大概率会被主线吸收,独立多模态模型和主模型之间的边界会慢慢消失。这等于DeepSeek在多模态这件事上,从"另开一扇门"换成了"把门拆掉"。
接下来要看什么9月10日之前,有deepseek账号的人可以把它那个模型名填进去,摸一摸新架构的多模态手感。并发限在20,说明这还是在跑量试水阶段,算力没放开,谁先用谁占坑。测试时记得它是手动挂的,不会自动出现在选择器里,填错名字就直接报错。之后再等两件事:V4.1会不会正式转成GA,新架构的权重什么时候放开。眼下能拿到的信息就是平台那一段话。DeepSeek一向说"只认官方渠道的消息",所以这次V4.1更像是它先把下一步给一小撮用户看了,真正的结论还要等正式版落地才能下。
信息来源:DeepSeek API平台V4.1 Flash内测公告(经Hacker News,2026-09-08)、DeepSeek API官方变更日志(api-docs.deepseek.com/updates)、DeepSeek V4官方新闻页(2026-04-24)