和AI一起搞事情#5:技能进阶与Claude Design初体验
Claude Design 使用体验先汇报一下进度感觉越来越像4399小游戏了……本周新增功能✅ 背包系统包括原始中药、中药饮片、方剂、书籍。其中原始中药部分已提供AI生图素材。背包.gif✅ 辨证游戏壳子舌诊 → 脉诊 → 问诊 → 辨证 → 选方哈哈没看错, 我又又又重构了把分散的小游戏整合成了一整个辨证游戏辩证.gif✅ 煎药游戏壳子选方结束触发配伍煎药游戏学习方剂配伍。煎药.gif✅ Hermes Agent backendAI对话层跑通但未接入游戏。第一部分聊聊开发流程【refactor】开发不是线性的而是螺旋上升的当你反复多次修复相似的问题时或许说明你该定义标准或者重新抽象了。举个例子做游戏会有很多弹窗——游戏引导要弹窗每个小游戏有弹窗。当我反复看到不同弹窗出现相同的问题时弹窗大小不一花里胡哨毫无统一配色和风格文字溢出现象在多个弹窗反复出现多个弹窗只能打开没有退出按钮或退出按钮无法点击这个时候就该重构、抽象了。我的做法还是superpowers的技能串联Explore先让AI分析当前现状找出问题brainstorming给出重构和抽象设计writing-plans提供测试验收方案subagent进行重构开发图片但是反过来并不推荐AI一上来写代码就进行高度抽象。相反上来的代码应该以简洁为主。这里推荐 andrej-karpathy-skills:simplicity-first 原则先让代码跑起来再让代码优雅起来。图片【PROGRESS.md】长线任务进度跟踪是核心最初看到有人单独使用 TODO.md、PROGRESS.md我当时觉得纯属多此一举“又又又用产品经理管开发的方式来管AI了。直接把进度写到 CLAUDE.md 中每次重启对话直接重新加载不行吗”再一次证明纸上谈兵终是浅。这里面最核心的一个问题其实是我之前在渐进式加载这个技术本身一直没想明白的点如果这个信息模型需要完全阅读那还需要渐进式加载吗我原本以为是不需要的。但这里遗漏了一个问题模型在使用 read 工具读取文件时默认一般会读取100行不同Agent架构和工具会存在差异核心是工具设计为了避免无用信息充斥模型上文这样可以视获取信息决定是否继续读取。这就导致当你提供给模型的文件过于庞大、又杂糅了太多信息时模型会出现因为部分读取文件而带来信息遗漏。体现在我把项目架构、已完成状态、进行中状态全部写入 CLAUDE.md 中。结果发现模型在update项目状态时只更新了已完成但没有及时更新进行中状态导致反反复复围着一个任务来来回回地搞还有一次在 CLAUDE.md 中写了好多遍进度跟踪结果有的位置显示该任务已完成有的显示进行中最后连AI自己也搞不明白究竟做完了没有所以我做了调整PROGRESS.md当前正在做的任务细分进度TODO.md记录已完成信息大幅缩减 CLAUDE.md 的篇幅只保留最新项目架构、进度摘要初步试验这个组合效果最好。等我再确认下这两个文件的颗粒度感觉就可以搞到 precompact 的hook里面自动更新了——感觉比 compact 要好用不做总结和摘要只是单纯描述当前状态 下一步该做啥类似条件马尔可夫的特性。image【一切皆版本控制】AI作为顶尖牛马工作更要留痕事实证明不论是人在工作中还是AI在工作中留痕都是最重要的不论是 Git worktree还是 branch 管理其实都是为了一切行动皆被记录一切状态都可回滚这一点对于AI来说尤其重要。尤其对于一些测试性功能A、B、C三个方案不知道哪个好让AI都开发一遍直接用效果作为唯一对比标准但是需要注意版本控制绝对不要让测试性功能直接在主分支上哐哐造。因为上下文有限所以你不要天真地以为可以根据上下文进行回滚——不可能的。只有Git提交记录是唯一真相源。所以不论是测试性代码、设计文档、多版本对比、各种临时feature请一切皆留痕一切皆用分支或 git worktree 进行管理。确认无误再合入主分支如果效果不及预期直接废弃。这其实不是AI编程规范人类编程规范也是如此。第二部分技能进阶——创建、测试与引用【skill-creator】请把开发中每一次重复都变成技能请务必在开发中无数次想到该使用/skill-creator了上一章末尾就提到需要批量制作素材。比如背包中我需要批量生产中药素材所以就顺带手做了个中药素材生成技能。于是我用 /skill-creator 这个meta技能来制作技能支持“先通过豆包同时生成4个或9个不同的中药组图“图片对组图切割通过多模态模型识别图片文字进行文件命名代码自动扫描路径完成新素材的加入这样素材后续就能自动添加到游戏里了。图片但是做不到全自动。因为很多中药比较少见画出来错误比例很高——正确率也就70%。这里一定会有人说让AI做Verifier呀哈哈哈那准确率更低柴胡的图片AI连续4次识别出4种不一样的作物…所以还是需要懂中医的人一张张来筛选谁说AI完全替代人类的那做错素材的锅谁来背【skill-evaluator】没有通过检验的技能不是可用的技能之前提到试用过Anthropic在 skill-creator 里面更新的技能评估模块。但个人使用体验感觉evaluator的思路可借鉴但不必完全使用。至于验证技能的必要性…… 直接看图片吧。如果你不验证你会得到下面的药材素材图哈哈哈又是AI逗我开心的一天人参至于技能的评估说复杂也很简单技能的测试要尽可能接近真实使用场景——也就是可能缺少上下文的情况下也要实现技能的有效触发完整流程的遵循因此 skill-evaluator 需要保证每个测试query都有干净完整的上下文。Anthropic 用子进程起命令行实现的但我个人使用感觉“与其在对话里用不如直接脚本评估来得干净整洁。”还不受到对话执行时间、gateway超时时间的影响。总共几个步骤创建测试query集bash命令行遍历每个query是一行claude 命令把中间所有Agent结果解析到md文件让AI直接批量评估结果简单、直接、高效。提高技能引用率好用的技能有不少但在使用中往往都面临有效技能引用率不高的问题。比如碰到bug修复并无法自动触发systematic-debugging技能开始写规划文档也无法触发writing-plans 技能如果把所有技能触发都手工命令触发的话又偏离了让AI自主进行长运行时coding的思路。所以在开发流程中有以下几个提高关键技能引用率的方案方案1链表式技能引用类似superpowers在每个技能文档最后明确 handoff 到下一个技能。image方案2中心式引用我当前的思路在 CLAUDE.md 的核心开发原则中通过中心式引用告知AI在哪些位置需要触发什么技能。图片方案3Hook中嵌入find skill我还看到有人在hook里面嵌入 find skill 技能默认任务开始前先搜技能。但个人感觉技能还是要符合开发者的习惯并且要切实解决当前AI Coding存在的问题。完全自动化搜索并接入并不一定是更好的方案。第三部分Claude Design初体验该说不说Claude Design来得太是时候了完全补齐我缺失的审美和空间想象力。在做出Claude Design高仿技能前先用Claude Design来画原型吧。先看对比图下面是文字描述直接转换成问诊对话框的效果。你说我没用设计技能不巧我还真用了并且我还对比了下不同对话框的风格然后有了下面的效果……截图_选择区域_20260429154546嗯……一定是我审美有问题……嗯。下面是Claude Design的效果图片当然在重复用了多次后发现缺少更多人的输入的话其实配色、效果会有些单一可能技能有几套visual rule覆盖了调色盘视觉元素规范等Claude Design的工作流程拆解先梳理下它的几个步骤0. 首先claude design提供了很多的设计类型覆盖prototype、slide-deck等等每种设计类型背后应该有不同的Design.md的设计和必要templateBrainstorming设计澄清对设计中的要点进行澄清包括风格配色元素动效Tweaks哪些元素你希望可以调整感觉就是 brainstorming 技能的UI版本。抛开低效的AI一问一答直接用页面多项选择呈现。这个技能应该有一个 tweaks 脚本或基类用于提供嵌入到HTML中的一些可变元素比如不同风格、不同配色截图_选择区域_20260504091210TaskList任务拆分拆分多个执行步骤开始分步骤进行Coding。imageFork Verifier Agent校验Agent触发校验Agent对代码进行验收。中间应该也隐藏了类似 webapp-testing 的技能因为我看页面打开了console会根据报错进行修复。imageExportClaude提供了代码打包以及html等各种格式的下载。不过最核心的是直接handoff to claude code的功能。会把整个项目打包并提供必要的README.md文件直接提供Claude Code 可以直接开始工作的完整上下文。图片总结哈哈说复杂流程也很简单。感觉核心在那个“handoff to claude code”的按钮为了把从设计到coding上

相关新闻

OpenClaw:容器化技术实现Agent开发硬件无关化

OpenClaw:容器化技术实现Agent开发硬件无关化

1. OpenClaw爆火现象解析:Agent硬件生态的平民化革命OpenClaw的突然走红绝非偶然。这个号称"无需Mac Mini也能1分钟部署"的Agent工具,正在颠覆传统硬件开发的门槛。过去要搭建一个可用的Agent开发环境,开发者通常需要购置至少一台M…

2026/7/22 9:41:35阅读更多 →
智赋岐黄:搭建中医全链条数字化基础设施,助推中医药现代化落地

智赋岐黄:搭建中医全链条数字化基础设施,助推中医药现代化落地

智赋岐黄是面向大健康机构的科技中医基础设施平台,而非单一设备或软件销售商。它通过整合中医AI大模型、四诊仪、互联网医院和智慧供应链等六大基础设施,帮助健康管理中心、连锁药店、养生门店等机构快速搭建可落地、可复制的中医AI服务体系。据平台资料…

2026/7/22 9:41:35阅读更多 →
Qt 一次性把多线程实现同步方式说清楚

Qt 一次性把多线程实现同步方式说清楚

概念(为何需要同步)1.多个线程同时读写共享资源(全局/静态内存变量、堆内存动态分配对象、文件/IO/网络句柄、外设资源等),执行顺序不确定,导致数据错乱、崩溃;2.同步主要是为了保证共享资源互斥访问、线程等待/唤醒、有序执行;3.测试(没添加同步)main.cpp #include <QCoreA…

2026/7/22 9:41:35阅读更多 →
下载工具还在用十年前的老古董?这款Rust写的神器,BT磁力流媒体全通吃,后台下载前台游戏不卡顿!

下载工具还在用十年前的老古董?这款Rust写的神器,BT磁力流媒体全通吃,后台下载前台游戏不卡顿!

下载大文件时&#xff0c;传统工具要么单线程慢到怀疑人生&#xff0c;要么多线程吃满CPU导致游戏掉帧&#xff0c;更崩溃的是下了一半断网&#xff0c;从头再来心态爆炸。想找个靠谱的替代&#xff0c;却发现要么广告弹窗烦死人&#xff0c;要么偷偷后台上传流量……如果你也受…

2026/7/22 10:55:45阅读更多 →
IT类产品CE/FCC/CCC认证对比解析:三大市场准入制度的技术要求差异

IT类产品CE/FCC/CCC认证对比解析:三大市场准入制度的技术要求差异

一、概述 CE认证、FCC认证与CCC认证是信息技术&#xff08;IT&#xff09;类产品分别进入欧盟、美国和中国市场的三项核心强制性认证制度。三者在法规体系、管控维度、测试标准与认证模式上各有特点&#xff0c;理解其差异有助于产品在全球化布局中合理规划认证路径。 三项认证…

2026/7/22 10:55:45阅读更多 →
国内规格尺寸齐全的内存条测试治具厂商芯片检测利器

国内规格尺寸齐全的内存条测试治具厂商芯片检测利器

在芯片测试这个领域&#xff0c;内存条&#xff08;DDR、LPDDR、HBM等&#xff09;的检测一直是个老大难问题。封装规格多、尺寸变化快、技术迭代频繁&#xff0c;让不少工厂在选型测试治具时头疼不已。今天&#xff0c;我们就来聊聊这家深耕23年的国内厂商——深圳市谷易电子有…

2026/7/22 10:55:45阅读更多 →
Skills短视频爆火背后的核心逻辑与创作方法论

Skills短视频爆火背后的核心逻辑与创作方法论

1. 项目概述&#xff1a;Skills为何突然爆火&#xff1f;最近打开任何社交平台&#xff0c;你肯定被各种"Skills挑战"刷屏了。从"科目三"舞蹈到"鸡蛋返生"魔术&#xff0c;从"伪音模仿"到"AI绘画速成"&#xff0c;这些被称为…

2026/7/22 10:55:45阅读更多 →
AI Agent开发指南:从原理到实践应用

AI Agent开发指南:从原理到实践应用

1. AI Agent初探&#xff1a;从概念到实践 最近在研究AI Agent这个领域&#xff0c;发现它正在快速改变我们与人工智能交互的方式。作为一个能够自主执行任务、设计工作流程并调用工具的系统&#xff0c;AI Agent已经远远超出了传统聊天机器人的范畴。它更像是一个数字员工&…

2026/7/22 10:55:45阅读更多 →
Tiva™ TM4C1299 LCD控制器寄存器配置与双缓冲驱动实战

Tiva™ TM4C1299 LCD控制器寄存器配置与双缓冲驱动实战

1. 项目概述与核心价值在嵌入式图形界面开发中&#xff0c;驱动一块LCD屏往往是项目从“能跑”到“好用”的关键一步。很多开发者拿到一块新的显示屏&#xff0c;照着厂家给的初始化代码配一遍&#xff0c;画面能出来就觉得万事大吉。但一旦遇到闪屏、撕裂、或者需要动态更新复…

2026/7/22 10:53:45阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中&#xff0c;我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源&#xff0c;还是配置文件、证书等&#xff0c;都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下&#xff0c;但这…

2026/7/22 0:53:59阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP&#xff08;轻量级目录访问协议&#xff09;作为企业级身份认证的黄金标准&#xff0c;已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时&#xff0c;发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 0:53:59阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击&#xff1a; https://intelliparadigm.com 第一章&#xff1a;AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”&#xff0c;而是以可解释、可审计、可迭代的方式&#xff0c;赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/22 0:53:59阅读更多 →
中小企业小程序开发公司怎么选:预算、上手和售后避坑指南

中小企业小程序开发公司怎么选:预算、上手和售后避坑指南

中小企业做小程序&#xff0c;最常见的矛盾是预算有限&#xff0c;但又不希望功能太单薄&#xff1b;没有技术团队&#xff0c;但又希望后续能自己运营&#xff1b;想快速上线&#xff0c;又担心隐性收费和售后失联。选型时如果只看“低价套餐”或“案例数量”&#xff0c;很容…

2026/7/22 0:01:17阅读更多 →
GEO优化如何沉淀长期内容资产?广拓时代谈AI搜索时代的内容ROI

GEO优化如何沉淀长期内容资产?广拓时代谈AI搜索时代的内容ROI

企业做营销&#xff0c;最怕钱花完了&#xff0c;资产没有留下。 效果广告能带来一段时间的曝光&#xff0c;但预算停止后&#xff0c;流量往往也随之停止。短视频内容可能在几天内冲高&#xff0c;也可能很快沉下去。AI搜索时代&#xff0c;企业需要重新思考一个问题&#xff…

2026/7/22 0:01:17阅读更多 →
Agent 终态判定:何时该停止思考、给出最终回复

Agent 终态判定:何时该停止思考、给出最终回复

Agent 终态判定&#xff1a;何时该停止思考、给出最终回复 一、你的 Agent 在"再想想"的循环里绕了 12 轮&#xff0c;用户已经关窗口了 Agent 与人最大的区别是&#xff1a;人知道什么时候该停下来给答案&#xff0c;Agent 会一直"想"下去。你给 Agent 接…

2026/7/22 0:01:17阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时&#xff0c;发现推理速度只有可怜的 1-2 FPS&#xff0c;而别人的演示视频却能跑到 30 FPS 以上&#xff0c;那么问题很可能不在模型本身&#xff0c;而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后&#xff0c;会直接使用官方示例…

2026/7/21 22:53:50阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一&#xff1a;为什么你需要了解 Coze 和 Dify&#xff1f;如果你对 AI 应用开发感兴趣&#xff0c;但一看到“大模型”、“智能体”、“工作流”这些词就头疼&#xff0c;觉得门槛太高&#xff0c;那这篇文章就是为你准备的。很多开发者&#xff0c;包括我自己&#…

2026/7/21 18:53:30阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会&#xff1a;配图一直是个让人头疼的问题。2026年&#xff0c;AI生图工具已经非常成熟了&#xff0c;但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1&#xff1a;速度之王2026年6月11日&#xff0c…

2026/7/21 18:53:30阅读更多 →