已放弃GPT6 Sol跟6 Luna,两个老六

已经放弃使用6 Sol跟6 Luna。面对模棱两可的指令,它们总会猜错。跟之前5.6完全不同。

它们好像缺乏某些“常识”。比如我在一个项目说,合并所有仓库的PR,6 Sol有可能会跑去合并目前GitHub账号下所有PR。甚至6 Astra可能也会。

image.png

试了几次,5.6 Sol没有触发这个问题。

image.png

后来我多次问GPT 6 Sol Ultra,它也认为PR范围应当在项目中。但它之前就是那么爽快地执行了:

image.png

Luna 6的问题会更严重一点,它连问题本身可能都理解错误。

image.png

而Luna 5.6不会:

image.png


善于应对“模棱两可的指令”,对不熟悉软件开发的用户非常重要,且能节省不少精力。这是我之前推崇5.6Sol的一大原因(程序员可以考虑用Claude)。

而这两个老六模型,用下来的体会,大约是「可能出错,它就错给你看」。如果你平常不喜欢把指令想得比较精确,再发给这两个老六,就得盯着它们干活,不然就给你整出什么幺蛾子。

对了,Sol 6还会频繁问用户问题,有不少是看一眼代码就看得出来的。

image.png

也就是,会「该问的不问,不该问的又问」。

回到5.6Sol呢?其实5.6Sol也有更新,Ultra现在也会停下来问用户问题。而不像以前那样一步到位。这种一步到位,貌似只剩下6 Astra。

那我就有个疑问:这个 6 Astra,是不是才应该叫6 Sol,而现在的6 Sol,应该改成缺失的6 Terra?

ChatGPT Image Sep 24, 2026, 02_35_50 AM.png

对了,还有个别场景,5.6Sol跟6Sol做出来的成果可以说是一模一样,犯的错误也一样。