Lode 需求雷达
--卡片
--主题
--失败
GitHub项目说明 · 非用户反馈

评估或迁移新开源 Agent 框架时,需要官方文档之外的一手运行实测

DeepSeek 开源 Agent 框架 Harness 后,作者在 24 小时内跑通并整理出一本橙皮书,公开完整系统提示词、129 行出厂启动清单、三份原始会话日志、AI 自造工具全程及 PTC 成本账单,明确对应官方文档缺失的一手信息。

查看原始信号github:alchaincyf/deepseek-harness-orange-book

目标用户

用过 Claude Code、Codex、OpenClaw 等工具、想评估或迁移到新开源 Agent 框架的用户;包括不写代码的 AI 工具使用者与想了解实际行为的工程师。

潜在需求

需要比官方发布稿更贴近实际使用的信息:完整系统提示词、129 行启动清单、三份未删改会话日志、AI 现场为自己造工具 19 步全程,以及 PTC 5 次开口编排 15 次操作和固定开销反而涨 9% 的成本实测。

发生场景

DeepSeek 于 2026 年 8 月开源 Agent 框架 Harness,官方发布稿以介绍架构和构建方式为主;用户在自己机器上装上后会关心开机装载了 129 个插件、写入前如何审批、一次任务花多少钱、会不会动硬盘其他文件。

来源证据

作者在 Harness 发布后 24 小时内完成一手实测,公开官方文档没有的完整系统提示词、129 行启动清单、三份未删改会话日志及 AI 现场自造工具的 19 步全程。

--profile web --dump-default-config`导出,一行行看它开机装了什么 - **三份原始会话日志**——标准模式、PTC、创造模式各一份,一条事件都没删 - **AI现场给自己造工具的全程**——19步,工具清单从32行变成33行,多出来的那一行是它自己写的 - **PTC实测账单**——5次开口编排15次操作,以及那笔反直觉的账:固定开销反而涨9% - **35个不随产品安装的扩展包清单**——都在npm上,但不在安装闭包里,「仓库里有」不等于「装上就有」 - **代码库考古**——12,293次提交/约64天、683篇Agent Note、4篇事故复盘(含「100%覆盖率全绿,编辑器一连上就崩」) ## 本书结构 | 部分 | 内容 | |------|------| | **序章** | 探索未至之境:你装的到底是什么,以及替你做掉那道四选一 | | **Part 1 进门** | 十分钟干成第一件活 · 它被允许碰什么 · 四种模式人话版 · 从Claude Code搬家,哪些能直接用 | | **Part 2 主线** | 每一次运行都有迹可循
https://github.com/alchaincyf/deepseek-harness-orange-book

为什么值得留意

新框架发布后,官方叙述与用户实际运行之间的空白快速形成了可验证的内容供给:发布 24 小时内就出现以一手试运行、逐项实测和迁移对照为载体的文档产品,说明这类信息缺口有真实用户在处理,且已被作者用免费书册和多格式分发验证。

已有方案

  • DeepSeek Harness 官方发布稿(以框架如何构建、什么架构为主)
  • 官方仓库内的被否决设计方案与事故复盘等一手材料

未满足部分

  • 官方文档未覆盖完整系统提示词、129 行启动清单、三份原始会话日志、PTC 实测账单等信息
  • `~/.agents/skills` 被零配置读走这类行为细节文档不会告诉用户

可能延伸 · 模型推测

  • 将同一套开箱实测模板复用到后续新发布的 Agent 框架,形成可比较的一手评估基线
  • 把成本账单、权限审批、自造工具等实测过程做成可自动采集的审计脚本或报告
  • 将官方文档与实测日志对照生成迁移决策清单(能用/要自己装/用不了)

目前未知

  • issue 反馈称该书内容粗糙、层次不分明,阅读体验差,可能影响这类内容的可用性
  • 没有材料显示该需求是普遍现象,样本仅限作者对单一框架的一次实测
  • 书的免费分发与作者既有读者基础可能使其传播效果高于一般内容供给

继续核实

  • 其他 Harness 用户或迁移评估者是否也在寻找同类的一手运行实测?
  • 现有 AI 工具用户群对分析官方文档之外的实测信息的需求是否稳定或增长?
  • 针对新发布框架的快速开箱实测内容,是否有可重复的形态或分发渠道?

主题词

agent framework onboardingunofficial documentationtool buildingcost accountingmigration evaluation

管理令牌