DeepSeek 的新模型 V4 Pro 正式版发布后,网上一片叫好声,有人甚至直言其性能达到了 Fable 5 级别的水准,仿佛是核弹直接把某些竞争者压得喘不过气来。可另一边,不少网友却对涨价表示不满,对于模型实际能力也颇多质疑,更有甚者怀疑是不是部署了错误的模型版本。
这次 DeepSeek V4 Pro 的更新,虽然未必是技术上的最大飞跃,却是评价上最为两极分化的版本。支持与反对的声音此起彼伏,让人想起薛定谔的猫,不知梁圣道还是梁白开?仿佛一切都处于不确定的状态。
回溯过去的一段时间,许多人体验到的 DeepSeek 都并非完整版本。细心的人们可能已经注意到,从 V4 Flash 正式版开始,DeepSeek 官方发布的模型跑分数据下方,总会附注一行小字:这些测试成绩均是在 DeepSeek Harness,即 DSH 环境下取得的。
这里不妨简单解释一下 Harness 的概念。简单来说,大模型就像一个极具智慧的头脑,但要让它发挥作用,比如编写代码、搜索信息或者执行复杂任务,就需要给它配上合适的“机甲”和“神经系统”。在人工智能领域,这个为模型接入工具、管理运行状态的外骨骼,就被称为 Harness。同一款模型,在不同的 Harness 比如Codex、ClaudeCode、Workbuddy等环境下,表现出的能力也大相径庭。因此整个 AI 界都对 DeepSeek Harness 抱着浓厚的兴趣,想知道它究竟有何神奇之处能够大幅提升模型跑分。
终于,完整的 DeepSeek 图景逐渐清晰,期待已久的 Harness 工具正式发布。有了这个工具,DeepSeek V4 Pro和Flash才能充分释放它们的潜能。
这个 Harness 工具的能力究竟有多强?从参与内测的程序员们构成的头像集合中,便可窥见一斑,其强大程度令人咋舌。我们也在预览版发布后第一时间进行了体验,用过后只能感叹:这或许不适合所有新手,却是上限极高的 AI 工具。
因为你可以亲手设计和调整 Harness 的每一个组成部分,修正任何觉得不完美的地方。这理念看似复杂,但实际操作起来并不算难。我们可以从最基础的 UI 界面入手来谈:初次见到 DSH,其外观与网页版的 DeepSeek 颇为相似。左侧边栏用于查看记录,右侧为主交互对话框,聊天框左上角可以选择工作区域,右下角则可调整模型及推理强度。这些都是我们熟悉的布局。不过,仔细观察后,你会发现 DeepSeek 提供了一个独特的功能:可以在标准、极简、PTC、创造这四种工作模式间轻松切换。
深入研究了这四种模式后,发现它们各具特色。标准和极简模式相对直观,标准模式就是我们日常使用的模式,简单测试了一下,让它快速创作了一个 MC 传送门游戏,整个过程花费了 1.56 元。极简模式则主要用于模型测试,去除了冗余功能,让模型的表现更加纯粹。而新加入的 PTC 模式,则显得有些特别,经过探究,意识到它的核心目标只有一个:教会 AI 更高效地工作。










网友评论