9月10日,杭州深度求索人工智能基础技术研究有限公司(DeepSeek)正式发布DeepSeek V4.1 Flash模型。
据介绍,这是该公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。
公司相应下调了V4.1 Flash的API定价,同时,为了更合理地调配资源,仍然采用峰谷定价,闲时价格为高峰时段价格的一半。新价格于2026年9月10日12:00开始生效。
编辑丨瑜见