从”价格屠夫”到”涨价有理”?DeepSeek Harness深度体验:缓存命中率99%,多步骤任务能力碾压,开发者:这波涨价我认了

8月13日晚,DeepSeek两件大事同日发生:开源智能体框架Harness v0.1正式发布,同时API大幅涨价,高峰时段缓存命中价格暴涨12倍。这一”开源+涨价”的组合拳,在开发者社区引发激烈讨论。然而,经过深度体验后,不少开发者表示”原谅了涨价”。实测显示,Harness采用”一切皆插件”架构,缓存命中率高达99%,13步复杂任务工具调用仅需2.4秒,长程任务能力远超同类产品。有开发者评价:”这是Agent时代的安卓。”当框架本身足够强大,API涨价似乎也变得可以接受了。

一、同一天,两件大事

2026年8月13日,DeepSeek在AI投下了两颗”炸弹”。

第一颗炸弹:DeepSeek Harness v0.1正式开源。

这款被开发者称为”黑鲸”的Agent框架,以MIT协议全面开源,GitHub Star一夜突破5万。它采用”一切皆插件”的开放架构,模型、工具、技能、沙箱、UI等所有Agent能力均由插件组合而成,可自由替换、灵活重组。

第二颗炸弹:API大幅涨价。

同日,DeepSeek宣布自8月17日起采用峰谷定价机制。以V4 Pro为例,高峰时段缓存命中输入价格从0.025元/百万Token涨至0.30元,涨幅12倍;输出价格从6元涨至27元,涨幅4.5倍。即便是空闲时段,价格也分别是此前的6倍和2.25倍。

“开源Harness”与”大幅涨价”同时发生,初看似乎矛盾——一个在吸引开发者,一个在提高使用成本。但深度体验过后,很多开发者说:”我原谅它涨价了。”

二、深度体验:Harness到底有多强?

13步任务,工具调用仅2.4秒

根据内测用户公开的实测数据,在一轮13步的复杂任务中,Harness的表现令人印象深刻:

  • LLM推理耗时:51.8秒
  • 工具调用耗时:仅2.4秒
  • 首Token平均耗时:0.8秒
  • 输出速度:135 Tok/s
  • 缓存命中率:高达90%

这意味着,模型”思考”占了主体,而工程执行几乎”无感”,用户体验非常流畅。有开发者评价:”用了一天V4 Flash搭配Harness,百万Token输入仅1元,输出2元,搭载自家低价模型后性能反超贵了57倍的海外旗舰。”

缓存命中率:99%,甚至100%

Harness专门在屏幕底部设置了一个实时统计面板,开发者可以随时查看Token消耗量、缓存命中率。实测中,缓存命中率大多处于99%左右,有几次直接干到了100%。

缓存命中率高的意义在于:当缓存命中时,Token价格极低。这是DeepSeek此前”便宜”的核心工程来源,也是涨价后缓存价格涨幅最大的原因——因为缓存命中率实在太高了。

长程任务能力:一句prompt跑20分钟

这是Harness最让开发者惊喜的能力。在测试中,仅输入一句”生成猪八戒3D白模”,Harness直接跑了20分钟,自主完成了从建模到渲染的全流程,极少返工。

相比之下,同样的任务在Codex上只跑了6分钟,但交付质量明显不如Harness。有社区开发者反馈,最长的一次任务跑了10个小时,依然稳定执行。

一位开发者评价:”DSH驾驭下,模型的长程任务能力会强非常非常多。一句prompt直出,很少出现直接交付半成品的情况。”

三、”一切皆插件”:Agent时代的安卓

Harness最核心的设计理念,是”一切皆插件”。

它基于自研的Cordis插件系统构建。Cordis可以理解为”乐高的底座板”——开发者不需要从零开始搭建,而是有一块带凸点的底板,然后往上插各种零件。

这种设计的优势在于:

可替换性:模型、工具、策略、存储、上下文管理……所有组件都是可插拔的积木。想换模型?换一个插件就行。想加功能?挂一个新插件即可。

可定制性:开发者可以针对特定场景定制运行时。官方内置了四种预设(标准/极简/PTC/创造),也支持完全自定义。

社区生态:光是在内测期间,开发者们已经贡献了约300个插件,涵盖UI修改、长期记忆、会话管理、Agent自我整理等功能。官方已经内置了100多个插件。

一位开发者形象地比喻:”Codex骨子里还是iPhone这类闭源哲学——Rust写单体核心,依靠外部挂件做扩展,你不能触碰主干。而DSH就是Agent时代的安卓——以Cordis为一等公民,打造了一套彻底开放的操作系统。”

四、好用的”黑匣子”:Trajectory轨迹功能

Harness还有一个被开发者称为”killer feature”的设计——Trajectory(轨迹)功能。

随着Agent运行时间越长、工具链越复杂,传统的Chat摘要越来越”黑盒”,开发者根本搞不清楚模型在背后做了什么。Harness的轨迹功能,是一个能随时监控Agent的回放窗口。

与Chat视图经过润色的对话不同,Trajectory能看到原始事件级记录——模型发过什么指令、调过什么工具、传过什么数据、花了多长时间,全部按序记录,一条都改不了。开发者可以随时回放,查看会话内部到底发生了什么,精准定位模型在哪一步栽了跟头。

这种”全程留痕”的设计,让Harness在调试和优化Agent行为时具有巨大的优势。有开发者评价:”美国模型厂商的API恰恰把这层数据藏了起来,而DeepSeek把它做成了核心功能。”

五、涨价12倍,为什么开发者”原谅了”?

回到最核心的问题:API大幅涨价,为什么开发者反而说”原谅了”?

原因一:涨价后仍然远低于海外竞品。

即使按照高峰时段的价格计算,V4 Pro输出27元/百万Token,折合约3.9美元。而Claude Fable 5的输出价格约50美元/百万Token,OpenAI的顶级模型价格更高。DeepSeek即使涨价后,价格仍然只有海外竞品的十分之一甚至更低。

原因二:Harness框架本身大幅降低了Token消耗。

Harness的缓存命中率高达99%,意味着大部分Token走的是极低的缓存价。虽然缓存价涨幅最大(12倍),但绝对值仍然很低——从0.025元涨到0.30元,每百万Token多花0.275元。对于大多数开发者来说,这个增加的成本远低于框架带来的效率提升

原因三:Harness开源,模型可以换。

由于Harness不绑定DeepSeek自家模型,支持接入OpenAI、Anthropic、Google等近40家模型提供方。如果DeepSeek的API价格涨到无法接受,开发者完全可以切换到其他模型。这种”模型中立”的策略,让开发者在面对涨价时有更多的选择权。

原因四:框架本身的价值远超预期。

一位开发者总结得很到位:”买了梁叔叔的API,接DSH还是Codex?结论很简单:自家模型肯定是优先搭配自家Harness。不然也没必要单独做一个了。”

当框架本身足够强大,API涨价就变成了”优质服务对应合理价格”的逻辑。

六、软盟观:开源框架+涨价API,DeepSeek的”阳谋”

DeepSeek在同一个晚上做两件事——开源Harness、涨价API——看似矛盾,实则是一套完整的商业逻辑:

开源的是框架,涨价的是算力。

Harness开源,是为了争夺AI执行层的标准。让更多开发者和企业基于Harness构建自己的Agent生态,将Harness变成”AI时代的安卓”。一旦生态形成,用户迁移成本就会越来越高。

API涨价,是为了让商业模型可持续。DeepSeek此前以”价格屠夫”形象抢占市场,把API价格打到地板价,吸引了大量开发者。但当用户规模增长到一定程度,可持续的商业化就成了必然选择。

两件事合在一起,信号很清楚:DeepSeek不再满足于当”便宜好用的模型供应商”,而是要做”AI基础设施的规则制定者”。

Harness开源,是吸引开发者入局。API涨价,是让生态持续运转。两者搭配,形成了一套”开源框架锁定生态+API服务实现变现”的商业闭环

对于开发者而言,Harness的发布确实值得”原谅”涨价——因为框架本身的价值,已经远远超过了API涨价的成本。


本文由软盟资讯编辑原创,转载须注明出处。

关于文章版权的声明:

https://news.softunis.com/68534.html 文章来自软盟资讯

若非本站原创的文章,特别作如下声明:

本文刊载所有内容仅供提供信息交流和业务探讨而非提供法律建议目的使用,不代表任何监管机构的立场和观点。不承担任何由于内容的合法性及真实性所引起的争议和法律责任。

凡注明为其他媒体来源的信息,均为转载,版权归版权所有人所有。

如有未注明作者及出处的文章和资料等素材,请版权所有者联系我们,我们将及时补上或者删除,共同建设自媒体信息平台,感谢你的支持!

(0)
上一篇 2026年8月14日 21:23
下一篇 2026年8月14日 21:30

相关文章推荐

发表回复

登录后才能评论