
DeepSeek-V4-Flash正式版API怎么用?实测速度超GPT
DeepSeek-V4-Flash正式版API于7月31日开启公测,用户可通过官方API直接接入使用,模型在架构不变的情况下,仅靠后训练优化实现了Agent能力的大幅跃升,且成本极低。
一、API接入:两种方式快速上手
官方API直连:开发者可通过DeepSeek官方API文档申请并获取API Key,调用模型名为
deepseek-v4-flash
,base URL不变,支持100万token上下文和38.4万token最大输出,可同时使用思考和非思考模式。
Codex适配集成:正式版原生支持Responses API格式,并专门针对OpenAI Codex进行了适配。开发者可在Codex CLI、VS Code的Codex插件以及ChatGPT桌面端中,将DeepSeek配置为模型提供方,一键切换无需额外改造。
二、接入成本:极致性价比的定价策略
API定价:输入1元/百万token,输出2元/百万token,缓存命中时输入低至0.02元/百万token。
成本优势:依托约98%的缓存命中折扣,单任务成本比降价后的GPT-5.6 Luna仍低约60%。输出价格仅为Kimi K3的约1/50,比GLM-5.2也便宜一个数量级。
峰谷定价预告:官方预告未来将实行峰谷定价,每日9:00-12:00、14:00-18:00的高峰时段价格将翻倍(生效日期待公布)。
三、使用效果:实测场景与能力定位
任务处理速度:开发者实测在相同任务和提示词下,V4-Flash正式版+Hermes约40秒完成任务,而GPT-5.6 Sol+Codex需1分47秒。
Agent与代码能力:Terminal Bench 2.1得分82.7,DeepSWE从预览版的7.3暴涨至54.4,前端代码竞技场以1586分位列开放类别第3。
适用场景:适合大批量自动化Agent任务、代码开发、工具调用和长文档分析等,在偏推理、代码和长文本处理方面表现出色。注意:目前仅API可用,App和网页端模型未同步升级。

