9月8日,据多方消息确认,DeepSeek V4.1-Flash 正式悄然开启中间版本内测。该版本引入了全新的模型结构,实现原生多模态支持,同时带来更强的综合能力、更快的运行速度以及更低的调用成本。开发者可保持 base_url 不变,将模型名称设置为 deepseek-v4.1-flash-expires-on-0910 直接调用,当前计费标准与 DeepSeek-V4-Flash 保持一致。外部反馈显示,该 Flash 版本最显著的标签是“速度极快”。8月21日,官方刚宣布多模态视觉理解模型 V4-Flash-Vision-Exp 上线 API 平台,其纯文本能力与正式版持平,视觉理解 AgentBenchmark 测试大幅跃升,多模态 Agent 能力接近 Opus-4.8。开源生态方面,8月13日 DeepSeek Harness v0.1 开发者预览版以 MIT 协议开源,24小时内 GitHub 获超7万星。此前 DeepSeek V4 Pro 已推出并增强 Agent 能力,官方同步调整 API 价格体系,引入峰谷分时定价机制。此次 V4.1-Flash 内测标志其在多模态与性能优化道路上迈出关键一步。