近距离观察了朋友怎么用 AI,然后给了一些建议。
背景是我们合作在写一套培训课程,有比较特殊的文件要求 (scorn),我们两人精力有限,都想借助 AI 完成大部分工作。我们的分工是我朋友负责文字和图片内容,我负责除此之外的所有。
所以最近几周,我构建了大量的工具,比如课程内容写在 yml 文件里,然后可以渲染成 html,这样就可以在浏览器里预览所有内容和交互。还把客户的要求全都提炼出来,形成一套半自动生成内容,全自动渲染部署的系统(他们非常主观,没有系统性的书面要求)。
结果和我朋友之前产生了不小的 gap,我在项目里特地为她的 agent 优化,这样只要她的 claude 读到项目,理论上就可以无缝衔接。但无论怎么试,发现有巨大的隔阂。
直到今天近距离观察她是怎么用的,才发现原因:
1. 她打开 cluade desktop,然后手敲一大行 prompt,让 claude 根据素材生成 prompt;
2. 然后把相应的文件和上面的 prompt 放到千问的聊天框里,让千问干活;
3. 然后再把千问的结果贴回 claude,然后又问 claude 哪些地方需要插图,并要它生成图片的 prompt;
4. 再把这些贴到 Meta AI 里的聊天框,生成图片。再下载回来,丢给 claude。
如此反复。
我建议她:
1. 使用 paseo 来调度不同的 agent;
2. 安装 opencode,这样可以用 qwen 的 API,而且不贵。
3. 可以在 paseo 里直接用 claude 调用 opencode cli。让 claude 读到项目的上下文,然后生成相应的 prompt,直接调用 qwen 生成内容;
4. 预览之后,要求 qwen 修复一些问题;
5. 然后让 claude 查看什么地方适合插图,看看项目里是否已经有爬取的图片或者生成的图片可以直接用,没有的话,生成 prompt 丢给 codex 去生成图片;
6. 然后把生成的图片,和相应的 prompt 写成图片描述,存到 manifest 里。以后再用的时候,就可以通过 manifest 直接定位到图片。
对了,以上几步都生成了 skill,以后她都不用怎么手敲 prompt 了,只要 / 就能调用 skill
Post #1158
11
Forwarded from DPS Main