DeepSeek Harness 内测获评宇宙最强 V4-Flash 登顶全球调用榜
DeepSeek 又有大消息
今天,一条关于“DeepSeek Harness 团队微信公众号近日已完成注册”的消息刷屏。券商中国记者查阅后确认,该公众号已注册,头像与 DeepSeek 官微头像颜色不同,为“黑色鲸鱼”。
值得注意的是,网上自称参与内测的网友给出的评价是:内测 2 天之后,愿意称 DeepSeek Harness 为“宇宙最强”。不过,Fable 之后的大模型即将发布,OpenAI 也准备了 GPT-6,大模型竞争仍处于“你追我赶”的状态。
此外,DeepSeek 最新发布的 V4-Flash 模型登顶全球调用榜。数据显示,7 月 27 日—8 月 2 日当周,DeepSeek-V4-Flash 以 7.22 万亿 Token 调用量登顶 OpenRouter 全球榜首。
DeepSeek Harness 热度飙升
近日,深度求索“DeepSeek Harness 团队”公众号正式注册,认证主体为“北京深度求索人工智能基础技术研究有限公司”。公开信息显示,该公司由杭州深度求索人工智能基础技术研究有限公司 100% 持股。
根据社交媒体信息和媒体报道,DeepSeek Harness 于 2026 年 5 月内部立项,独立组建 Harness 专项核心团队,由崔添翼担任负责人。6 月下旬,崔添翼曾在社交平台发文称,作为新成立部门,团队目标宏大且工作繁重,人员仍非常紧缺,“我每天都在面试,也在各个平台发布些招聘小广告”。
在官方招聘信息中,DeepSeek 给出了“Model + Harness = Agent”的公式,并表示:
“我们正在把 DeepSeek 的前沿模型能力,转化为领先的 Agent 产品。其中除模型本身以外的所有工作,都属于 Harness 的范畴。”
8 月 1 日,崔添翼面向全球公开征集 Harness 内测用户,优先筛选具备 Agent Harness 开源项目经验的开发者,申请人需提交代码托管平台账号与代表作品。
Harness 可以被理解为模型之外的一切工程化能力,是真正让模型“跑起来”的系统。2026 年,Harness 直接带动了 Vibe Coding——即“代码智能体”——成为 2022 年“GPT 时刻”以来首个成功商业化的杀手级应用,最知名的两款 Harness 为 OpenAI 的 Codex 和 Anthropic 的 Claude Code。
分析认为,Harness 内测落地暗藏着 DeepSeek 跳出低价算力竞争、重构商业模式的核心战略,标志着 DeepSeek 正式从单一的基础模型供给者,全面转型为全链路 AI 工作流解决方案的构建者。而从号称“参与了 DeepSeek Harness 内测的网友”反馈来看,评价非常高。不过,限于保密要求,具体表现一直没有明确说法。
V4 系列一度登顶全球
7 月 31 日,DeepSeek 正式发布 DeepSeek-V4-Flash 正式版 API 并上线公测,同步开源模型权重。
OpenRouter 数据显示,8 月 2 日当周,DeepSeek-V4-Flash 以 7.22 万亿 Token 调用量位居全球第一,8 月 1 日单日处理达 8 万亿 Token。全球 AI 大模型周总调用量 56.8 万亿 Token,中国模型周调用量 28.13 万亿 Token,连续十四周超过美国。
国盛证券表示,DeepSeek-V4-Flash 正式版在模型架构与参数规模上与 4 月预览版完全一致,全部能力提升源自后训练阶段的策略优化。该模型正式版在涵盖代码工程、终端操作、全栈开发等 9 项 Agent 基准测试中全面超越 V4-Pro 预览版,后者总参数为前者的近 6 倍。大模型能力增长正从参数规模扩张转向训练策略优化,后训练的效率可能优于单纯的规模堆叠。
DeepSeek-V4-Flash 采用混合专家(MoE)架构,总参数 2840 亿,每次推理仅激活 130 亿,在保持知识容量的同时大幅压缩推理成本。架构层面,V4 系列采用 CSA 与 HCA 交替的混合注意力机制,通过分层压缩策略实现百万 Token 上下文的高效推理。与 V4-Pro 相比,V4-Flash 并非简单缩水版本,而是主打均衡性价比与原生硬件适配性,面向高并发业务场景。
另外,DeepSeek-V4-Flash 定价极具竞争力:
- 每百万输入 Token 收费 0.14 美元
- 每百万输出 Token 收费 0.28 美元
- 缓存命中仅 0.0028 美元,98% 的缓存折扣率显著高于行业普遍的 90% 水平
以加权单任务成本衡量,V4-Flash 完成每项测试平均成本约 0.03 美元。对比同梯队轻量模型,GPT-5.6 Luna 在 7 月 31 日降价 80% 后,单任务成本为 0.05 美元,仍为 V4-Flash 的 1.7 倍。这一成本结构使 V4-Flash 成为当前规模化 AI 应用落地的最优选择之一。
值得注意的是,DeepSeek-V4-Flash 权重以 MIT 协议开源发布后,首月下载量超百万,V4 系列稳居 HuggingFace 热门模型榜首,社区