TGViewer
LINUX DO Channel LINUX DO Channel @linux_do_channel · 37.8K subscribers
Post #523402 74
sun of beach (@h1xy) 在 2026/10/1 编程模型推荐 推理强度越高一定越好? 中发帖

省流版:(基于以下评测) 

最新模型Opus 5.5,GPT-6.1 Sol 的确效率高,但思考强度选Medium就好, 效果好还省钱
简单项目用GPT-6 Luna,思考强度一定选Max
国产就考虑Kimi K3和GLM 5.3 flash

评测原文: FrontierCode Leaderboard | Cognition
以下为手写版。AI润色版稍后发公众号。
Cognition公司(Devin开发商)发布了其FrontierCode 1.1的最新排行榜,加入了新鲜出炉的GPT-6.1 Sol以及Claude Sonnet 5.5的评测结果。

FrontierCode专注于代码正确性和代码质量,也是第一个衡量可合并性的基准:代码维护者是否愿意合并这个AI生成的PR?
我们的标准使用一系列评分技术(包括单元测试、评分标准和新型验证器)来评估端到端代码质量(正确性、测试质量...
More from @linux_do_channel
  1. Sep 30, 2026Anny (@annyc) 在 【Zcode】远程控制突然报错upstream object storage error 中发帖 upstream object storage e…
  2. Sep 30, 2026LLMeme 在 OpenAI 称挫败了一起模型蒸馏活动 中发帖 和之前 A\ 相对详细的报告不同,OpenAI 只点了 Kimi 一家,也没有多少细节 [image] 从昨天Op…
  3. Sep 30, 2026@imperatorcaesar 在 Gemini 4 Argon跑分匯總 中发帖 [BA011F4A-E516-4E84-8DEB-ED948BFDD466] [image] […
  4. Sep 30, 2026k9527 在 这个gpt6-astra的鹈鹕怎么怪怪的 中发帖 [image] 感觉被风控了,这个鹈鹕不像,我是pro用户,求助一下大佬这种情况怎么排查解决,谢谢
  5. Sep 30, 2026@13owen 在 这样用会很爽吗 中发帖 [6b8e93e92a464c383ba4fb5883d16274]
  6. Sep 30, 2026寻茶 (@xuncha) 在 gpt bps通道似乎也开始降智了 中发帖 rt 感觉bps跑的不是很满意 随手测了一下 [image] [image] [image]
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →