(来源:优刻得云计算)
优刻得一站式AI开发平台星图AstraFlow上新DeepSeek-V4.1-Flash模型。这是DeepSeek全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。V4.1-Flash能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。
非对称模型结构,小成本大智能
DeepSeek-V4.1-Flash为552B参数的MoE模型,采用了全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1-Flash还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek-V4-Pro在内的一众旗舰模型的智能水平。
DeepSeek-V4.1-Flash与主流前沿模型在Agentic Benchmark上的性能对比更少缓存,更省成本
新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。
DeepSeek-V4.1-Flash在减少上下文存储方面的持续进展,相对于初代模型,KV Cache已经缩小了437倍。
视觉理解并入主力模型
此前,DeepSeek通过V4-Flash-Vision-Exp提供实验性质的视觉能力。此次发布V4.1-Flash后,文字与图片处理进入同一个主力API模型。
开发者可以让模型描述图片、识别截图文字、分析图表。图片可以通过公开链接传入,也可以编码后直接提交,或通过Files API上传后引用。这对处理真实资料的Agent有实际意义。统一模型入口,可以减少开发者在不同模型之间分配和切换任务的工作。
在基础规格上,V4.1-Flash支持100万Token上下文、最大384K输出,以及JSON Output、工具调用、Responses API等功能。模型同时提供思考与非思考模式,默认开启思考,思考强度支持low、high、max三档,开发者可以根据任务复杂度配置。
上星图调用DeepSeek-V4.1-Flash
步骤一:注册并登录AstraFlow星图
平台地址:https://astraflow.ucloud.cn/
步骤二:实名认证
使用服务前用户需要完成实名认证。
步骤三:创建API Key
进入模型服务平台-密钥管理。
平台地址:
https://astraflow.ucloud.cn/modelverse/api-keys
curl -X POST "https://api.modelverse.cn/v1/chat/completions" \-H "Content-Type: application/json" \-H "Authorization: Bearer your-api-key" \-d '{"model": "DeepSeek-V4.1-Flash","messages": [{"role": "system","content": "你是一名资深的全栈软件工程师,擅长前端开发、后端架构设计以及现代 Web 技术栈"},{"role": "user","content": "帮我设计并编写一个个人博客网站,包含首页、文章列表、文章详情页,使用 React + Node.js 技术栈"}],"thinking": {"type": "enabled"},"reasoning_effort": "max","stream": true}'
下载星图客户端,无需复杂配置,即可一键调用DeepSeek-V4.1-Flash。无论是代码开发、资料整理、深度调研,还是PPT与文档生成,都能在一个客户端内高效完成,让强大的模型能力真正转化为触手可及的Agent生产力。