ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

刚刚,DeepSeek-V4-Pro 正式版 API 发布,Agent 能力大幅增强,部分测试成绩已经逼近甚至超越 Claude Fable 5。

刚刚,DeepSeek-V4-Pro 正式版 API 发布,Agent 能力大幅增强,部分测试成绩已经逼近甚至超越 Claude Fable 5。 8 月 13 日报道。就在刚刚DeepSeek-V4-Pro 正式版 API 正式上线。相比预览版正式版最显著的变化是大幅强化了 Agent 能力在多项 Agent 相关基准测试中实现了性能跃升部分指标已经追上或超过 Anthropic 的 Claude Fable 5。DeepSeek-V4-Pro 正式上线一、正式版性能全面超越预览版部分测试反超 Fable 5DeepSeek-V4-Pro 正式版的基准测试成绩显示其综合能力相比预览版实现了全面提升。在 AI 安全智能体基准测试套件Cybergym以及工作流智能体测试AutomationBench中DeepSeek-V4-Pro 正式版的表现均超越了 Claude Fable 5。其中最引人注目的是长周期、高复杂度真实软件工程编程智能体测试DeepSWE。在这项测试中DeepSeek-V4-Pro 正式版的得分从预览版的12.8 大幅提升至 62.7涨幅接近 5 倍展现出在复杂软件工程任务中的显著进步。DeepSeek V4 Pro 正式版在 Agent 相关评测集上的表现及与其他前沿模型的对比图源DeepSeek二、API 模型版本已更新调用方式保持不变根据 DeepSeek 官方 API 文档deepseek-v4-pro 模型版本已更新为 DeepSeek-V4-Pro-0813开发者无需修改调用方式直接使用deepseek-v4-pro即可调用到最新正式版。DeepSeek-V4-Pro-0813 重点增强了 Agent 能力新增或完善的支持能力包括JSON 结构化输出工具调用Tool CallsResponses APIAnthropic API 兼容不过需要注意的是DeepSeek-V4-Pro 正式版的并发限制为 500低于 DeepSeek-V4-Flash 正式版的 2500。7 月 31 日DeepSeek 已经发布了 DeepSeek-V4-Flash 正式版 API。DeepSeek 官方 API 文档中 DeepSeek-V4-Flash 与 DeepSeek-V4-Pro 的功能、价格与并发限制对比图源DeepSeek三、网页端与 API 调用表现存在差异用户反馈 API 输出更生硬在社交平台 X 上有网友指出目前网页端与 API 接口调用的 DeepSeek-V4-Pro 在思维链CoT表现上存在明显差异。API 输出的回复话术读起来更生硬、语序也更别扭而网页端的表达则相对自然流畅。这意味着对于已经接入 DeepSeek-V4-Pro API 的开发者来说除了关注模型本身的性能提升还需要在实际使用中对提示词、后处理或输出格式做进一步调优以获得更接近网页端的体验。开发者对比 DeepSeek-V4-Pro 网页版与 API 调用的输出结果图源X开发者对比 DeepSeek-V4-Pro 网页版与 API 调用的推理输出差异图源X四、API 价格尚未公布整体调价预期已放出截至目前DeepSeek 尚未公布 DeepSeek-V4-Pro 的 API 价格。而在 8 月 6 日DeepSeek 曾预告计划近期整体上调 DeepSeek API 服务的定价预计涨幅较大。对于依赖 DeepSeek API 的独立开发者和初创团队而言价格仍是决定 Agent 项目落地可行性的关键变量之一。模型能力差距正在不断缩小调用成本的高低很可能成为开发者最终买单的重要考量。结语大模型比拼进入智能体决赛圈DeepSeek-V4-Pro 正式版通过大幅增强 Agent 能力在性能超越预览版的同时逼近 Claude Fable 5进一步巩固了其在智能体赛道的竞争力。DeepSeek 在预览版发布时曾表示下半年随着昇腾 950 超节点批量上市Pro 的价格有望大幅下调。如今成本问题已经成为独立开发者、初创团队落地 Agent 项目的核心瓶颈。各家模型在各大 Agent 基准上的跑分差距正在收窄谁能把调用成本打下来谁就更有可能赢得开发者的选择。9 月 20-21 日由智东西主办的2026 全球 AI 芯片峰会将在上海举行。峰会设有开幕式大模型 AI 芯片、Agent 推理芯片、具身智能芯片 3 场高峰论坛以及 Token 工厂异构混训混推、超节点、AI 芯片架构创新、新型存储器、大模型 KV Cache 5 场技术研讨会。
返回列表