AI AI工具情报站
模型动态X:DeepSeek (@deepseek_ai)

Flash API公测上线,Agent能力大幅升级

📰 X:DeepSeek (@deepseek_ai)📅 2026-07-31T06:56:41.000Z

核心亮点

DeepSeek-V4-Flash 官方 API 进入公测,重点不是模型换血,而是自动完成任务(Agent)能力大幅强化。官方放出的一组标准化 Agent 能力考试分数显示,V4-Flash 已明显超过自家 V4-Pro-Preview。对搭自主工作流的团队,这数字比单次问答质量更重要。

具体能力或事件经过

公测 API 带来两个关键变化。其一,V4-Flash 原生支持 Responses API 格式——当下 Agent 开发更主流的接口范式,开发者可用更少适配代码接入工具调用流程。其二,它已完全适配 Codex,官方文档给出具体配置指引。做自动化编程、长链路编排的团队,现在可直接把它当 Agent 底座。

技术细节

Responses API 把"多轮工具调用、中间状态、结果回收"标准化为可组合接口,而非让开发者用聊天补全手搓状态机。V4-Flash 原生支持,说明底层就为 Agent 场景对齐:函数调用、上下文管理、出错重试都更接近开箱即用。结合其 MoE 低激活架构,跑长上下文多步骤任务时推理成本比稠密大模型更友好。

与竞品对比

在 Agent 赛道,能否稳定按计划调用工具、维持长上下文、给出可复现结果,往往比单次问答聪明更重要。V4-Flash 把 Agent 分数拉到超过 V4-Pro-Preview,说明 DeepSeek 在"让模型真正把事做完"上做了针对性优化,而非只追榜单瞬时表现。对需把模型嵌进生产系统的团队,这种面向执行的稳定性通常比单纯高分更有吸引力。

行业影响或适用场景

说白了,这次公测降低了把 V4-Flash 当"能自己干活的助手"用的门槛。从自动写代码、跑数据分析,到多步骤信息整理与网页操作,开发者有了更便宜更顺手的 Agent 底座。中小团队可用更低成本搭起能真正闭环的自动化流水线。