查看: 22|回复: 0

[AI工具] DeepSeek Harness 从 0 到 1详细拆解

[复制链接]
发表于 2026-8-15 17:07:00 |江苏| 显示全部楼层 |阅读模式

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
DeepSeek Harness 从 0 到 1详细拆解
核心观点一句话V4 Pro 实际 Agentic Coding 效果远低于官方宣传;DeepSeek Harness 架构值得研究,但当前版本不适合普通人当主力工具。
目录:
背景与定位DeepSeek V4 Pro(1.6T 总参、49B 激活、1M 上下文)主打 Agentic Coding,已正式开放。
8月13日同步开源 DeepSeek Harness(Developer Preview),重点不在模型,而在模型外面的执行框架。

模型 vs Harness 的本质区别模型 = 大脑(推理 + 生成)
Harness = 手 + 工作台 + 门禁 + 行车记录仪
(负责读规则、写文件、跑命令、权限拦截、会话恢复、工具执行)

作者本地实测用 Node.js 启动 Web 界面,接 API Key。
做了最小控制实验:新建 result.txt → Shell 验证文件是否存在。
轨迹页可完整看到:系统提示、AGENTS.md、权限、每次模型请求、工具参数与返回值。
权限拦截有效(只读环境能拦住写操作),但拦不住模型“胡说任务已完成”。

DeepSeek Harness 的设计亮点核心理念:Everything is a plugin(几乎所有层都可拆换)。
自带 4 套 Agent 预设:标准、PTC(TypeScript 组合工具)、极简、创造模式。
可替换:模型适配、文件系统、Shell、权限、会话、子 Agent、UI 等。
对做企业 Agent 的人吸引力大(可接公司网关、KMS、审批流)。

与现有工具对比vs WorkBuddy:WorkBuddy 是成品工作台(交付结果优先);Harness 是可拆装运行时(适合自己造轮子)。
vs Codex:Codex 产品完成度更高、拿来即用;Harness 更开放、轨迹更透明,但体验不成熟。

V4 Pro 真实表现举例公开测试生成 Three.js《我的世界》小游戏:思考近20分钟,初版有明显 bug(人物持续下坠),修后可玩但功能有限。工具流程跑通 ≠ 产物合格。

谁该现在研究 / 谁先别折腾建议研究的人:正在开发 Agent / 编码助手 / 内部 AI 工作台
需要接公司网关、本地模型、自定义权限
想看清工具调用与上下文流动
能接受版本变动和自己排错

建议先别装的人:只想一句话出 PPT / 网页 / 报告 / 代码
需要成熟桌面体验和远程协作
不想处理 Node.js、API Key、插件配置
准备直接上生产却没有安全/测试团队

企业落地还差什么Harness 只解决中间运行时。
还需要:业务连接器、凭据管理、审批流、长期状态、验收规则、审计日志、失败重试等。
FDE 的核心价值正在这里:把现场验证过的权限模板、评测集、验收规则沉淀成可复用资产。

作者最终结论普通用户:不用急着装,成品工具(WorkBuddy、Codex 等)更省事。
Agent 开发者 / 企业 AI 落地者:值得尽早拆开研究,把它当作公开的 Agent 底盘。
模型只决定一部分上限,真正决定 Agent 能不能稳定做事、会不会越权的,是外面的 Harness。

在线完整阅读:

游客,如果您要查看本帖隐藏内容请回复



HPqk_QVbYAERcqV.jpg
理想阁www.li325.com有你更精彩!
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注微信公众号
小黑屋|版权声明|侵权投诉|免责声明|捐助支持|理想阁

相关侵权、举报、投诉及建议等,请发 E-mail:liranqing2008@Gmail.com

Powered by Discuz! X5.0 © 2001-2026 理想阁论坛.|晋ICP备2026000046号-1

在本版发帖
客服微信
返回顶部