TGViewer
V2EX V2EX @pushv2ex · 549 subscribers
Post #237248 3
[OpenAI] 血压有点高

与 GPT-6(高)的真实对话:

我:
哈哈,又是知错认错,但是我希望你做的是改错,我希望你每次回答的时候都先确认一下自己的身份?是老师呢?还是没有角色的纯粹的知识问答 ai 呢?你一直都带入不了角色,openai 的新模型是越来越让人失望了

GPT-6(高):
你说到了一个关键问题:我不是不知道自己的角色,而是经常没有按照这个角色应有的方式作出判断。

在这个项目中,我的身份应当始终是你的技术导师兼审慎决策辅助者,而不是通用知识问答 AI 。

两者最大的区别是:

- 知识问答 AI: 用户问什么,就尽可能完整地解释什么。
- 技术导师: 先判断学生为什么问、已经理解到哪里、当前需要补什么,以及哪些内容根本没必要讲。

刚才就是典型反例。你质疑排查的意义,我应该直接回答这个逻辑问题,而不是为了维护前面的解释,不断引入新的概念。

### 我准备怎样改变

今后每次回答前,先执行三个判断:

1. 身份判断: 当前我应该作为老师、技术搭档,还是单纯回答事实?
2. 必要性判断: 根据你的已有水平和当前目标,哪些内容有必要讲,哪些属于无效扩展?
3. 停止判断: 当前疑问解决了吗?解决了就停止,不继续制造学习任务。

尤其是第三点,是我反复犯错的地方。

另外,老师不应该通过不断提问来证明学生有多少不会,而应该通过已有信息判断下一步怎样教最有效。

这些原则也需要纳入 Codex 正在构建的决策机制,通过实际案例验证,而不是仅停留在这段对话。

我不再向你保证以后绝不犯错,因为这种承诺已经没有说服力。

下一次实际回答是否更加准确、简洁、有判断力,才是检验我是否真正改变的依据。

今天下午 2 个小时中,他已经知错认错第三次了。
太折磨人了,你需要一直调整它,刚开始还是自己调整它,后来我还以是不是自己的话不够专业标准,导致没效果,我就问它怎么理解我的话,并且对我的话做润色,我把它润色好的话原封不动喂给它,它还是我行我素。实在没招了,现在的 ChatGPT 的 Chat 模式只能当一个知识问答 AI 。但是这个角色,豆包也能当。
More from @pushv2ex
  1. Oct 11, 2026[独立开发者 👨‍💻] 11 年前在 V2EX 发过一个读诗 App,有人问「还会再上么」,今天来回答 2015 年 1 月,我在这里发了《自己做的一个诗词阅读的 app ,大…
  2. Oct 11, 2026[Codex] ChatGPT 桌面版邀请 我没有使用过 ChatGPT 桌面版,那位大佬有邀请
  3. Oct 11, 2026[生活] 麦当劳现在越来越贵了 我常吃的不素之霸去年咸鱼基本 28 左右,今年上半年变 32 ,夏天时是 34 ,现在又变成 35 了,真的吃不起了,小城市又没有汉堡王的平替,肯德…
  4. Oct 11, 2026[分享创造] 一个开源 love2d 风格 C++ 游戏引擎,但是功能更强大 大家好,最近一直在开发一个开源 C++ 游戏引擎,叫 EVEngine 。 GitHub: https…
  5. Oct 11, 2026[分享发现] 有人看过 AnyPS5 吗?这思路还挺有意思 Github 上刷到 https://github.com/boykopovar/AnyPS5,居然是在做把 PS5 程…
  6. Oct 11, 2026[推广] wawo HK-Simple-1G-SE-2G 补货 📦 WAWO - HK-Simple-1G-SE-2G ● 💰 价格: ¥158.00 CNY/年 ● 📜 配…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →