DC娱乐网

【DeepSeek-V4-Flash:把“去年最强”塞进你的卧室机箱】DeepS

【DeepSeek-V4-Flash:把“去年最强”塞进你的卧室机箱】DeepSeek发布了V4-Flash-0731,这款模型在智力评分上拿到了50分,几乎追平了几个月前最顶尖的闭源模型。虽然它是个拥有160GB权重的“大家伙”,但凭借MoE架构(每次只激活13B参数)和量化技术,现在只要花2000到5000美金组一台配有192GB内存和双3090显卡的二手机器,就能以每秒10到30个Token的速度在本地跑起来。这件事最重要的信号是,顶尖AI的“本地化门槛”正在从企业级显卡阵列降维到高端玩家的桌面。虽然有人质疑MoE模型在深度推理上不如同规模的稠密模型,但对于开发者来说,能以极低成本获得Sonnet级别的本地算力,意味着隐私和离线自动化的天花板被捅破了。现在的核心矛盾不再是“能不能跑”,而是“买硬件的钱够充多少年API”——当DeepSeek把API价格打到1.6美金能买1.8亿Token时,本地部署正从“刚需”变成一种对数据主权的极致浪漫。 reddit.com/r/LocalLLaMA/comments/1vchoua/deepseekv4flash0731_models_you_can_run_locally