今天,发布我们正式发布 DeepSeek V4.1 Flash 模型。具备觉理解这是原生我们全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。多模调A定新模型结构的态视设计初衷是:能力上限更高、推理速度更快、力下ex外汇官网网站入口吞吐更大、发布可扩展到更大参数模型。具备觉理解
非对称模型结构,原生小成本大智能

DeepSeek V4.1 Flash 为 552B 参数的多模调A定 MoE 模型,采用了全新的态视 Causal-Encoder-Decoder 结构,输入和输出不对称,力下输入激活只有 8B,发布输出激活 16B,具备觉理解成本显著低于已知的原生ex中文官网同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。


DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比


更少缓存,更省成本

新一代模型大幅减少了 KV Cache 缓存的ex官网中文版大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。在 Agent 使用场景中,缓存命中的费用往往占比较高,对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。


如图展示了 DeepSeek 在减少上下文存储方面的持续进展。相对于初代模型,KV Cache 已经缩小了 437 倍。
API支持
DeepSeek V4.1 Flash 已同步上线 DeepSeek API,原生支持多模态,将模型名称更改为 deepseek-flash 即可调用最新的 V4.1 Flash 模型。旧版本模型 V4 Flash 与 V4 Flash Vision Exp 现已下线,出于兼容考虑,模型名 deepseek-v4-flash、deepseek-v4-flash-vision-exp 将被暂时路由到 V4.1 Flash。
同时,经多方测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro,因此我们计划有序下线V4 Pro 模型。北京时间 2026 年 9 月 14 日 12:00 之后,至未来 V4.1 Pro 上线之前,用户访问 deepseek-v4-pro 的请求将全部路由到 V4.1 Flash,并按 V4.1 Flash 单价计费。
腾讯(WorkBuddy、CodeBuddy)和 OpenCode 作为官方合作伙伴,现已全量接入 DeepSeek V4.1 Flash,欢迎使用!
API定价调整
得益于模型架构的创新,DeepSeek V4.1 Flash 能够以更低的成本服务更多的用户,因此我们相应下调了 V4.1 Flash 的定价。同时,为了更合理地调配资源,我们仍然采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。新价格于 2026 年 9 月 10 日 12:00 开始生效。



今年6月,一家第三方域名监测机构发布的月度报告显示,仅5月单月,全网新增名称中含“Ex”的金融类站点就有47个,其中12个在页面标题里直接写成“Ex外汇官网”,比去年同期多出近三成。同一时期,某投资者

8月中旬,一位做跨境电商的用户在Ex提交了3800美元出金申请,到账用了51小时,比上一次同样金额的6小时慢了整整两天。钱一分没少,但时间差在哪,得把流程拆开看。Ex的出金实际分两段:平台内部审核,和

2月的第三周,ex平台官网的登录页做了一次不小的调整。记者实测发现,原本挤在一屏的"账号密码/短信验证/扫码"三个入口被拆成上下两栏,短信验证按钮的响应时间从此前的约6秒压到2秒出头。这个变化对每天要

2025年3月,境外域名监测机构Netcraft的季度报告里有个数字:全球被举报的金融仿冒站点中,外汇与差价合约类约占11%,其中相当一部分域名与正规平台只差一到两个字符。exness用户基数大,自然

2024年3月,福州一位交易者在Ex外汇平台做了200手EUR/USD,月末对账时发现实际支出比预想多出近400美元——问题不在行情判断,而在点差、佣金和隔夜利息这三笔账没有提前算清。进入2024年,

3月中旬,某股份制银行跨境业务柜台的数据显示,当月"ex类账户"开户咨询量比1月增长了约40%,其中近六成客户卡在"手续材料"环节被退回补件。所谓ex开户,通常指企业或个人在特定交易平台/银行开的专用