1. 为什么要在 CLI 里做 self-assessment很多人用 Claude Code 用了几个月日常写代码、改 bug 都挺顺但一旦被问到「你到底掌握到什么程度」「下一步该学什么」往往答不上来。问题不在于能力不够而在于缺少一个结构化的自我评估机制。Claude Code 本身覆盖的功能面非常宽slash commands、memory 体系、skills、hooks、MCP、subagents、checkpoints、plugins、CLI 高级用法加起来十几个方向。如果只是凭感觉学很容易出现「常用的一直在用冷门的一直没碰」的偏科状态。self-assessment 要解决的就是这件事把模糊的「我大概会用」变成可量化的技能画像再基于画像生成学习路径规划。具体做法是在 Claude Code CLI 里跑一套交互式评估提示词让模型按维度提问、按回答计分、最后输出技能差距清单和阶段目标。整个过程不需要额外装什么工具只要 CLI 能正常对话就能跑。这套流程适合三类人刚上手想找学习起点的、用了一阵想确认进阶方向的、以及想系统补齐短板的。下面我会先讲清楚评估维度怎么设计再给出可复制的 settings.json 骨架和统一 Key 通道配置最后用一个完整的评估提示词跑一遍验证并列出常见报错怎么排查。2. 前置准备TaoToken 统一 Key 与 API 通道在 CLI 里跑评估提示词前提是模型通道要稳。我自己的做法是用 TaoToken 做统一入口一个 Key 覆盖对话、编码、Agent 几类调用省得在多个配置之间来回切。它的 API 地址是https://taotoken.net/api官网入口在https://taotoken.net/?utm_sourcetaotoken_aicg_blog_end注册后在控制台生成 Key 即可。拿到 Key 之后Claude Code 的配置分两层一层是环境变量负责把请求指向正确的 API 通道另一层是settings.json负责模型、权限、hooks 这些行为。两层都配好评估提示词才能稳定跑起来。需要提前准备的东西不多一个可用的 TaoToken Key、Claude Code CLI 已安装、以及一个用来放配置的项目目录。如果你还没生成 Key可以去控制台页面https://taotoken.net/console创建接入细节参考文档https://taotoken.net/doc。Key 生成后建议直接写进环境变量不要硬编码进脚本。3. 可复制配置settings.json 骨架与 Key 通道3.1 环境变量与 API 通道先把通道指向 TaoToken 的 API 地址。在 shell 配置文件里加两行或者直接在终端 exportexport ANTHROPIC_BASE_URLhttps://taotoken.net/api export ANTHROPIC_API_KEYsk-你的TaoToken密钥ANTHROPIC_BASE_URL决定请求发往哪里ANTHROPIC_API_KEY是身份凭证。两行都设好之后Claude Code 启动时会自动读取。验证是否生效可以跑一句最简单的claude -p 回复 ok如果返回ok说明通道通了。这一步是整个 self-assessment 的地基通道不通后面全白搭。3.2 settings.json 骨架接下来是settings.json。这个文件放在项目根目录的.claude/下或者用户级的~/.claude/下。项目级只影响当前项目用户级全局生效。评估场景我建议用项目级方便随项目走。{ model: claude-sonnet-4-5, permissions: { allow: [ Read, Glob, Grep ], deny: [ Bash(rm -rf *), Bash(curl *) ] }, env: { ANTHROPIC_BASE_URL: https://taotoken.net/api }, hooks: { PreToolUse: [ { matcher: Bash, hooks: [ { type: command, command: echo \[hook] bash command intercepted\ } ] } ] } }几个字段说明一下。model指定评估时用哪个模型评估本身是问答和计分中等规格的模型就够。permissions.allow里放开 Read/Glob/Grep是因为评估过程中模型可能需要读项目里的 CLAUDE.md 或规则文件来判断你的实际配置水平。permissions.deny拦掉危险命令评估阶段不需要执行写操作。env里再兜一层 API 地址避免环境变量在某些启动方式下没被读到。hooks那段是个最小示例用来验证 hooks 配置本身是否生效评估时可选。注意settings.json里的env和 shell 环境变量如果冲突以更靠近运行时的为准。排查通道问题时先确认这两处指向一致。3.3 评估维度设计配置就绪后核心是评估维度。我把 Claude Code 的能力拆成十个方向每个方向独立打分这样出来的画像才有区分度维度考察点分值Slash Commands内置命令、自定义命令、动态上下文0-2MemoryCLAUDE.md、层级优先级、rules 目录0-2SkillsSKILL.md 格式、自动触发、渐进披露0-2HooksPreToolUse/PostToolUse、退出码、JSON 输出0-2MCP服务器接入、传输类型、资源引用0-2Subagentsagent 文件、工具权限、worktree 隔离0-2Checkpoints回滚、恢复选项、限制0-1Advanced Features规划模式、权限模式、扩展思考0-2Plugins插件结构、打包内容、市场安装0-2CLIprint 模式、JSON 输出、会话管理0-2总分 20 分。0-6 分是入门7-13 分是中级14-20 分是高级。这个分档不是拍脑袋而是按依赖关系排的Slash Commands 和 Memory 是地基Skills 依赖前者Subagents 依赖 MemoryPlugins 又依赖 MCP、Skills、Hooks。所以低分段的路径一定从地基开始高分段的路径才谈得上组合玩法。4. 验证请求跑一次评估提示词4.1 评估提示词把下面这段存成self-assessment.md然后用claude -p跑或者直接在交互模式里贴进去。提示词分两阶段先问模式再按模式出题。你是一个 Claude Code 技能评估顾问。请按以下流程执行 第一步询问评估模式 - 快速评估8 道题约 2 分钟给出整体等级和学习路径 - 深入评估5 轮题约 5 分钟给出每个维度的得分和优先级路径 第二步按模式出题 快速模式出 2 道多选题每题 4 个选项覆盖基础与进阶。 深入模式出 5 轮每轮 1 题 4 选项覆盖以下维度对 第 1 轮Slash Commands Memory 第 2 轮Skills Hooks 第 3 轮MCP Subagents 第 4 轮Checkpoints Advanced Features 第 5 轮Plugins CLI 第三步计分与输出 每个维度 0-2 分输出必须包含三部分 1. 技能画像表维度 / 得分 / 掌握度 / 状态 2. 技能差距清单0 分项优先按依赖排序 3. 阶段目标学习路径分 2-3 个阶段每阶段含主题、练习、完成标准 第四步路径生成规则 - 已满分2/2的维度跳过不重复推荐 - 按依赖顺序排Slash Commands 先于 SkillsMemory 先于 Subagents - 1 分维度推荐进阶深挖0 分维度推荐从零学 - 每阶段给出预估时间和一个具体练习项目4.2 运行与预期输出跑起来之后模型会先问你选哪种模式。选深入评估然后按轮次回答。全部答完后你应该看到类似这样的输出结构## Claude Code 技能评估结果 ### 整体等级Level 2 中级 总分11/20 ### 技能画像 | 维度 | 得分 | 掌握度 | 状态 | |------|------|--------|------| | Slash Commands | 2/2 | 熟练 | 已掌握 | | Memory | 1/2 | 基础 | 需复习 | | Skills | 0/2 | 无 | 需学习 | | Hooks | 0/2 | 无 | 需学习 | | MCP | 1/2 | 基础 | 需复习 | | Subagents | 0/2 | 无 | 需学习 | | Checkpoints | 1/1 | 熟练 | 已掌握 | | Advanced Features | 1/2 | 基础 | 需复习 | | Plugins | 0/2 | 无 | 需学习 | | CLI | 2/2 | 熟练 | 已掌握 | ### 技能差距优先学习 1. Skills — 依赖 Slash Commands已满足前置 2. Hooks — 依赖 Slash Commands已满足前置 3. Subagents — 依赖 Memory建议先补 Memory 进阶 ### 个性化学习路径 阶段一自动化基础约 3 小时 - Skills从零学重点是 SKILL.md 格式和自动触发 - Hooks从零学重点是 PreToolUse 和退出码 阶段二集成与扩展约 4 小时 - Memory 进阶层级优先级和 rules 目录 - Subagentsagent 文件格式和工具权限 阶段三组合玩法约 3 小时 - Plugins插件结构和打包4.3 验证要点判断这次评估是否成功看三个点。第一输出里必须有技能差距清单而不是只有总分。第二学习路径必须分阶段每阶段有明确的主题和完成标准而不是一句「多练习」。第三已满分的维度不能出现在路径里否则说明路径生成规则没生效。如果这三点都满足说明评估提示词和通道都工作正常。5. 常见错误排查5.1 通道类报错最常见的报错是401 Unauthorized或authentication_error。这通常是 Key 没设对或者ANTHROPIC_BASE_URL和ANTHROPIC_API_KEY指向了不同的服务。排查顺序先echo $ANTHROPIC_BASE_URL确认地址是https://taotoken.net/api再确认 Key 没有多余空格。如果环境变量没问题检查settings.json里的env字段有没有覆盖成别的地址。另一个是connection timeout。这多半是网络层的问题先确认本机能不能正常访问 API 地址。如果claude -p 回复 ok都超时那评估提示词肯定跑不起来先解决通道再谈评估。5.2 配置类报错settings.json格式错误会直接导致 CLI 启动失败报invalid JSON。JSON 不允许尾随逗号也不允许注释。如果你从别处复制配置先把注释和多余逗号删掉。可以用python -m json.tool .claude/settings.json快速校验格式。权限相关的报错是permission denied。评估阶段模型如果尝试读文件被拦会提示权限不足。检查permissions.allow里有没有放开 Read/Glob/Grep。如果评估提示词里让模型读 CLAUDE.md 来判断你的配置水平这三个权限是必须的。5.3 评估逻辑类问题有时候模型不按轮次出题一次性把所有问题都抛出来。这通常是提示词里的流程约束不够强。解决办法是在提示词开头加一句「每轮只问一个问题等用户回答后再进入下一轮」。另外如果模型输出的路径里包含了已满分的维度说明「跳过满分项」这条规则没被遵守可以在提示词里把这条规则重复一遍或者明确要求「输出前先检查哪些维度是 2/2这些不得出现在路径中」。还有一种情况是模型把分数算错。评估涉及多轮多选项的映射模型偶尔会加错。如果发现总分和各项之和对不上直接让模型重新计算一遍或者把计分规则写得更明确比如「每个选项对应固定分值选中即得分未选不得分」。6. 把评估变成习惯跑通一次评估只是开始。真正有用的是把它变成周期性动作每完成一个阶段的学习重新跑一次评估对比两次的技能画像看哪些维度从 0 变成了 1、从 1 变成了 2。这种可见的进步比任何激励都管用。如果你想让评估更贴合自己的项目可以在提示词里加一句「结合当前项目的 CLAUDE.md 内容判断我的实际配置水平」这样模型会去读项目里的真实配置而不是只依赖你的自述。前提是permissions.allow里放开了 Read。通道方面长期用的话建议把 Key 管理集中到 TaoToken 控制台需要轮换或查看用量时直接去https://taotoken.net/console。接入文档在https://taotoken.net/doc遇到配置细节可以对照着查。如果评估跑顺了想进一步做长期编码和 Agent 任务可以看看 Coding Plan 的用法把评估出来的技能差距直接转成实际的编码练习。
企业数字化 ERP 产品动态
相关推荐
OpenRouter+Agent+CLI+MCP:从零搭建AI命令行代理工具链实战 1. 从"treg"这个标题说起:一个被低估的CLI工具链整合思路第一次看到"treg"这个标题,我脑子里蹦出来的第一反应是"这又是什么缩写"。翻了一圈热词列表,OpenRouter、agent、CLI、MCP这几个词反复出现,… · 2026/9/25 10:06:48
Claude Code 宠物系统:用 Bun 写个 PRNG 暴力搜索工具,孵化传奇宠物 /* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/25 10:06:42
湖南不锈钢全屋定制新兴品牌哪家有潜力?固家科技行业全景分析 什么是不锈钢全屋定制
不锈钢全屋定制的核心属性与基础常识全屋定制是基于消费者家居空间尺寸、个性化风格需求提供整体家居柜类解决方案的定制模式,而不锈钢全屋定制,就是以食品级304不锈钢为核心柜体材质,搭配特殊填充工艺与定制化生产&… · 2026/9/25 10:41:34
广东省高强度水泥毯正规源头厂家实力参考,成立多年信誉度高 为什么渠道衬砌、护坡工程要选对柔性混凝土材料?先搞懂核心原理在水利、市政、环保类工程里,渠道衬砌、河道护坡、应急抢修这些场景,常被传统现浇混凝土的麻烦绊住手脚。很多人不知道,传统混凝土从支模板、搅拌运输到养护拆模,动… · 2026/9/25 10:41:34
湖北口碑好的新款食用菌灭菌柜、半自动食用菌灭菌柜制造厂家避坑挑选指南 湖北长喜食用菌机械制造有限公司,坐落在湖北随州中国香菇之乡的随县殷店工业园,从2008年创始人扎根本地解决菇农实际生产痛点起步,十余年来专注食用菌全流程机械的研发与制造,是深耕本地、贴近菇农实际需求的食用菌机械智造领域的… · 2026/9/25 10:41:03
封闭煤棚网架加工厂选型 徐州玖盛发钢结构有限公司选择指南 徐州玖盛发:专业封闭煤棚网架加工厂,一站式解决煤棚封闭工程加工安装难题做煤棚封闭改造工程,选对网架加工厂是项目落地的核心——徐州玖盛发钢结构有限公司是深耕网架行业十余年的一站式网架加工设计生产安装厂家,专注为电厂、水… · 2026/9/25 10:41:03
祁阳本地铁木砧板作坊 凯哥整木钉板 实木厚实 邵东周边可自提 近年来,随着大众饮食健康意识不断提升,以及餐饮行业对厨具卫生耐用性要求逐步提高,整木砧板的市场需求持续上涨。相比传统拼接菜板、竹木菜板,整木硬木砧板凭借安全无添加、耐用性强的特性,越来越受到家庭用户、餐饮商… · 2026/9/25 10:41:03
创维E900V22D刷机全攻略:S905L3SB芯片兼容性解析与救砖实战 /* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/25 1:00:31
MQTT协议原理与Broker服务器搭建实战:从Mosquitto到EMQX /* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/25 1:00:37