受这件事情,最近一个月喜欢用小模型干活,V4 Flash类型的那种,什么国产模型匿名模型都在用。只有复杂的嵌套任务才会用 GLM 5.2( K3 出来后GLM都显得慢了)。
比较有意思,我发现小模型在目前普遍的harness下基本都能乖乖老实干活,只是偶尔会犯蠢——不知道怎么做傻在原地思考打转、自作主张用自己的方法尝试忽略原文档等等。这时候只要插嘴一句就能让它继续做下去。这已经不是实习生了,更像是班主任去差使高中生干杂活。
我觉得大部分人想让模型完成的就是这些脏活累活。如果这个提点的动作不是人来完成,而是让更聪明、更大参数量的模型来扮演班主任,会更加无感。
Post #2695
858
Forwarded from 搞机日记