7月31日,DeepSeek正式上线V4-Flash模型正式版API公测服务,定位高效低成本推理场景,同时官宣迭代旗舰模型DeepSeek-V4-Pro将于8月初正式发布。本次更新距离V4预览版上线间隔三个月,通过精细化后训练优化,全面提升模型智能体作业与代码处理能力,适配各类商用开发场景。
DeepSeek-V4-Flash采用轻量化MoE混合专家架构,总参数284B,单次激活仅13B参数,支持百万级超长上下文,可自由切换思考与非思考双模式,模型基础结构与预览版保持一致,仅优化后训练逻辑。该模型原生适配OpenAI Responses API格式,兼容Codex、Claude Code等主流AI智能体,开发者无需修改基础配置即可无缝迁移使用。
官方基准测试数据显示,新版模型在全栈开发、自动化任务、长文本推理等多项核心榜单中,成绩远超此前预览版本,多项指标跻身开源模型第一梯队。
同时模型大幅优化长上下文算力损耗,百万Token场景下单Token计算量仅为前代的27%,显存占用降至10%。定价方面极具性价比,Flash模型缓存命中输入仅0.2元/百万Token,大幅降低企业大模型落地的算力成本。
模型地址:DeepSeek官网

© 版权声明
若无特殊声明,本站所有文章版权均归灵境网原创和所有,未经许可,任何个人、媒体、网站、团体不得转载、抄袭或以其他方式复制发表本站内容,或在非我站所属的服务器上建立镜像。否则,我站将依法保留追究相关法律责任的权利。
相关文章
暂无评论...