TGViewer
NerdNest NerdNest @luxiangze · 30 subscribers
Post #1158 11

Forwarded from DPS Main

近距离观察了朋友怎么用 AI,然后给了一些建议。

背景是我们合作在写一套培训课程,有比较特殊的文件要求 (scorn),我们两人精力有限,都想借助 AI 完成大部分工作。我们的分工是我朋友负责文字和图片内容,我负责除此之外的所有。

所以最近几周,我构建了大量的工具,比如课程内容写在 yml 文件里,然后可以渲染成 html,这样就可以在浏览器里预览所有内容和交互。还把客户的要求全都提炼出来,形成一套半自动生成内容,全自动渲染部署的系统(他们非常主观,没有系统性的书面要求)。

结果和我朋友之前产生了不小的 gap,我在项目里特地为她的 agent 优化,这样只要她的 claude 读到项目,理论上就可以无缝衔接。但无论怎么试,发现有巨大的隔阂。

直到今天近距离观察她是怎么用的,才发现原因:

1. 她打开 cluade desktop,然后手敲一大行 prompt,让 claude 根据素材生成 prompt;

2. 然后把相应的文件和上面的 prompt 放到千问的聊天框里,让千问干活;

3. 然后再把千问的结果贴回 claude,然后又问 claude 哪些地方需要插图,并要它生成图片的 prompt;

4. 再把这些贴到 Meta AI 里的聊天框,生成图片。再下载回来,丢给 claude。

如此反复。

我建议她:

1. 使用 paseo 来调度不同的 agent;

2. 安装 opencode,这样可以用 qwen 的 API,而且不贵。

3. 可以在 paseo 里直接用 claude 调用 opencode cli。让 claude 读到项目的上下文,然后生成相应的 prompt,直接调用 qwen 生成内容;

4. 预览之后,要求 qwen 修复一些问题;

5. 然后让 claude 查看什么地方适合插图,看看项目里是否已经有爬取的图片或者生成的图片可以直接用,没有的话,生成 prompt 丢给 codex 去生成图片;

6. 然后把生成的图片,和相应的 prompt 写成图片描述,存到 manifest 里。以后再用的时候,就可以通过 manifest 直接定位到图片。

对了,以上几步都生成了 skill,以后她都不用怎么手敲 prompt 了,只要 / 就能调用 skill
More from @luxiangze
  1. Sep 22, 2026OpenAI 推出 ChatGPT for Word 插件,可在 Word 内起草编辑文档 OpenAI 推出 ChatGPT for Word,把 ChatGPT 能力带入 Mi…
  2. Sep 19, 2026https://x.com/kkawsb/status/2101043826714661033?s=52&t=VDQbddnF-Jy0dp0XZ7cpJg
  3. Sep 19, 2026https://x.com/nan7li/status/2096551677944033688?s=52&t=VDQbddnF-Jy0dp0XZ7cpJg
  4. Sep 19, 2026https://ip.skk.moe/split-tunnel
  5. Sep 19, 2026https://mimo.xiaomi.com/rl/ mimo-v2.6 实时训练进度
  6. Sep 18, 2026https://maxwellforbes.com/posts/dont-try-to-reform-science/
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →