当前标签#deepseek

DeepSeek V4.1 Flash 模型上线国家超算互联网

DeepSeek V4.1 Flash 模型今日上线国家超算互联网中心。用户可登录国家超算互联网官网,从首页进入「模型服务」页面,即可快速打开 DeepSeek V4.1 Flash 模型 API 调用界面。
据了解,DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。
同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。
此外,DeepSeek V4.1 Flash 大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。在 Agent 使用场景中,缓存命中的费用往往占比较高,对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。

DeepSeek 涨价 24 天后,V4-Flash

几十分钟以前,DeepSeek 团队成员 @Tianyi Cui 说:
鉴于 DS V4.1 Flash 模型在性能、费用、速度、总用时等各项指标上都全面超越了 V4 Pro。再以更高的价格、更慢的速度和更多的算力消耗给 DS 用户提供原有的性能较差的 V4 Pro 模型会不太合适。V4.1 Flash 正式上线之后,V4.1 Pro 上线之前,V4 Pro 模型的请求都会被路由到 V4.1 Flash,并按 Flash 的价格计费。
也就是说,用 V4-Pro 也相当于用 V4.1 Flash,价格也是。
我们将于北京时间2026年9月10日12:00起,调整flash系列定价:空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。请合理安排您的使用。
DeepSeek 在今年8月17日开始宣布涨价,当时最高涨幅达到了 12 倍:
DeepSeek API 全面涨价,8月17日起,最高12倍涨幅
在9月8日,发布 DeepSeek V4.1 Flash 测试版之后,其 API 平台出现了降价提示:
9月10日价格
北京时间2026年9月10日12:00起,deepseek-v4-flash 定价:
计费项目空闲期旧价空闲期新价高峰期旧价高峰期新价降幅
输入:缓存命中0.050.020.100.0460%
输入:缓存未命中1.501.003.002.0033.3%
输出4.504.009.008.0011.1%
注意,未提及 Pro 价格,也就是保持不变:
原文:/deepseek-flash-price-cut-24-days-after-price-hike

— 已显示全部 —