深夜上新,DeepSeek V4 Pro来了!智能体也开始跑步进场

冯恋阁
2026-08-13 15:06:48
来源: 开机实验室
DeepSeek搞了个大新闻。

(图源:图虫)

8月12日晚,DeepSeek悄悄在官网更新。

最新的模型与价格页面显示,Deepseek-V4-Pro对应模型版本已经更新为DeepSeek-V4-Pro-0813。

这意味着,千呼万唤的DeepSeek V4 Pro(以下简称“V4 Pro”)正式版来了。

虽然目前DeepSeek未公开正式发布公告,但开机实验室获悉DeepSeek已经在用户群确认了这一消息:DeepSeek V4 Pro正式版已经更新至API,调用模型名不变。

(图源:官网截图)

从目前公布的信息来看,deepseek-v4-pro 支持1M上下文长度,最大输出长度达到384K Token,同时支持非思考模式和思考模式。

deepseek-v4-pro支持 JSON Output、Tool Calls、Responses API、Anthropic API,同时支持Beta阶段的对话前缀续写与FIM补全。API接入方式上,则支持Responses API和Codex接入。

价格是近期DeepSeek被关注的重点,目前V4 Pro输入为3元/百万Tokens,若缓存命中则为0.025元/百万Tokens;输出价格为6元/百万Tokens。

对比DeepSeek V4 Flash,其输入1元/百万Tokens,缓存命中则为0.02/百万Tokens;输出价格2元/百万Tokens。这样比较下来,V4 Pro的输入、输出价格是V4 Flash的3倍,但是放在同行队列里,依然不算高价。

据开机实验室此前不完全统计,对于国内大模型,以输入价格来看,缓存未命中情况下,价格最贵的是阿里 Kimi刚刚推出的大模型K3,20元/百万 Tokens;最便宜的则是阿里 Qwen3.7-Flash,仅需要0.20 元/百万 Tokens。以输出价格比较,最便宜的是阿里 Qwen3.7-Flash,只要0.8元/百万 Tokens;价格最高的也是K3,输出价格为100元/百万 Tokens。其余国产大模型的价格也在这一区间内浮动。

从DeepSeek释放的 V4 Pro的首批跑分情况来看,新版本的一个显著亮点,在于增强了Agent能力,无论是与预览版,还是与其他家大模型比起来,都有可圈可点之处。

(图源:DeepSeek)

开机实验室发现,正式版本与预览版相比,DeepSeek正式版在10项Agent能力评测中全部实现提升,正式版提升最明显的集中在软件工程、网络安全这几项实战类评测。

DeepSWE主要评测AI智能体在复杂软件工程场景下的能力,在这项测评中,V4 Pro的得分从预览版的12.8分跃升至62.7分,接近翻5倍。

Cybergym考验的是Agent在真实世界的网络安全能力,在这项中,V4 Pro从52.7分升至 83.3分。

把正式版和国内外主流旗舰模型,如Kimi-K3、智谱GLM-5.2、Anthropic的Opus 4.8、Fable 5放在一起看,也会发现,这一代 V4 Pro主打的是"能干活",而不是"懂更多"。

Cybergym这项,V4 Pro得分排第一,略高于 Fable 5(83.1 分)和 Kimi-K3(80.0 分)。AutomationBench主要测Agent业务流程自动化能力,在这项中V4 Pro同样以31.8 分的成绩位列第一,高于 Kimi-K3(30.8 分)和 Fable 5(29.1 分)。

不过,在知识推理(HLE)、代码仓库生成(NL2Repo)、长程工具调用(Toolathlon)等项目上还是略低于友商的旗舰大模型。

值得注意的是,DeepSeek Harness的团队的轮廓,也在近期越来越清晰。

几天前,有消息称,DeepSeek Harness团队已经完成微信公众号注册。

开机实验室查询发现,公众号DeepSeek Harness团队确已注册,且认证公司主体为北京深度求索人工智能基础技术研究有限公司。

根据DeepSeek官网,这个团队在以研究、工程、产品相结合的方式,把DeepSeek的模型能力转化为前沿的科研突破与领先的Agent产品。

Harness究竟是什么?

一个能干活的智能体Agent,由大脑(模型)和手脚(Harness)组成。

模型负责理解需求、推理和生成方案;Harness负责读写文件、调用工具、运行代码、记忆管理等,简单来说,就是把模型能力落到真实环境中,完成从理解需求到交付结果的完整闭环。

目前,最为知名的两款Harness就是OpenAI的Codex和Anthropic的Claude Code。

(图源:微信截图)

据多家媒体报道,DeepSeek Harness于2026年5月内部立项,独立组建Harness专项核心团队,由崔添翼担任负责人。

公开消息显示,崔添翼毕业于浙江大学计算机系,加入DeepSeek前,曾在量化交易机构Jane Street任职约九年,后又以联合创始人身份在量化投资机构天市垣资本工作三年多,2026年3月,他加入DeepSeek Harness团队。

崔添翼此前在社交媒体发文称, DeepSeek Harness目前开放产品经理、研发工程师等岗位招聘。

(图源:网络截图)

如今,DeepSeek Harness和其背后智能体野心开始显山露水。

开源证券计算机行业点评报告认为,DeepSeek Harness框架首次亮相,承载Agent运行时与持续学习能力,推动Agent应用从原型验证阶段走向规模化商用落地。

海通国际指出,未来模型实际效果将越来越取决于“模型+Harness+工具+数据”的整体组合,单纯依靠基础模型能力建立壁垒的难度继续上升。

本网站上的内容(包括但不限于文字、图片及音视频),除转载外,均为时代在线版权所有,未经书面协议授权,禁止转载、链接、转贴或以其他 方式使用。违反上述声明者,本网将追究其相关法律责任。如其他媒体、网站或个人转载使用,请联系本网站丁先生:news@time-weekly.com

相关推荐
从电梯到大飞机!浙商王水福开启“西子系”资本新征程,C919一级供应商西子航空冲刺IPO
云动智能单一客户贡献高达九成收入,董事长李巍年薪酬超60万元|港E声
上市首日能赚7000万?理财子抢筹宇树科技,打新长鑫科技已浮盈2.1亿
扫码分享