GPT 5.6实际体验

admin 发布于 24 天前 39 次阅读


GPT5.6正式发布了

这次虽然不是整数版本的更新,但其实是一次比较大的更新。主要是前段时间claude fable 5的发布,openAI努力追赶,这次的5.6的能力在部分方面已经和fable5不相上下了。大模型的能力也正是从opus级别进入入到methys级别

之前飞本发布的时候我就想来尝试一下 作为世界顶尖大模型的能力到底是什么样的。但很明显因为政策问题可唠的的实际所需费用一直居高不下,而这次openai也发布了他们的模型。本身价格就比 fable5 便宜,更重要的是 OpenAI 的账号封控没有那么严格,在中转站的价格也就更便宜。

因为种种原因先尽快用的话就先用中转站吧,简单方便。

试了一下,让他做一个 Claude code。

这种大项目几乎一下就能很清楚的感觉到模型的能力,

比如像deepseekv4预览版的级别,基本的能力就是可能只能写小项目,这种文件架构较复杂的一旦多了连调用都会报错。

比如像GL m5.2级别。我觉得这才是真正能够开始开发这种级别项目的模型(最低也要glm5级别),但这种级别几乎无法做到几乎一次成型,基本上只能一点点慢慢来,我保守估计以我的性子如果有坚持的话怎么也得一周以上能够开发一个线上的成品,加上错误的改进可能得半个月。

但正如我说像my soul级别的模型,比如gpt 5.6 sol的 urtla,真的只要两次对话就能把这个程序开发的7788。这种感觉真的只有你亲自体验过了才会有,那种感觉靠语言是表述不出来的。

更直观的来说就按照我的经历来讲一讲我之前用DeepSeek开发,他对这种模型的理解仅限于区别于传统的AI聊天,ai可以通过调用工具来执行任务,所以它的开发一开始就是以这种体量为基础的,说白了就是一个简单的循环加调用工具的过程。

实际开发过程中,第1个版本弄完了一堆报错。我实在懒得改了,本身也不抱什么希望。

然后是GL m5.2至少他能够理解我就是一开始想要一个完整的AI编程工具,不仅限于最基础的demo,而是可多地的项目包括完整的各种功能。

但实际开发过程中我感觉他对代码知识库的理解并不足,做了一个看起来像的东西,实际用的时候总会报各种问题比如聊天是可以,但是一旦雕工具不同的工具有不同的处理,glm对其其中的处理就不太好,很多工具都不太对,不是调用工具失败就是前端显示出现问题。

而GPT,我上来就让他完整复刻,他第1轮花了将近三个小时自己跑,基本把整个全部做出来了,但一个比较关键的问题就是运行之后发现前端很素,我感觉它像是直接原生控制台打印的所以我告诉他使用和克劳德cos相同的技术战来完全开发并复刻功能,这次效果好了很多而且各种功能也就到位了感觉有一些小的瑕疵需要优化一下,但就像我说的,我感觉给我的话可能一天时间我就能开发一个几乎完整的程序。

我不知道怎么表述这种感觉,之前大家都在传AI编程,但实际只有用过才知道,之前的AI编程一直都算是一种辅助工具,它对于懂行的程序员可以减轻极大负担的手写代码。但如果让AI从0开始写一8个项目,小的demo玩具类可以很轻松,但实际的真正的工程基本上写一个崩一个。这种情况下,要么就是让人开始设计架构,让AI进行代码填充,要么就是AI写完一段之后对他的内容进行更改或者给a I提建议,无论如何这个项目都必须有人来参与,甚至是主导。但现在我感觉AI真的可以从零开始完全写一个项目,需要人对项目本身的参与越来越少,最后可能真的是灵感为王的天下,谁有好的灵感和想法谁就是真正的王者,你不需要学习代码,不需要学习软件,或者掌握一些特别浅显的基础,能够和AI交流就足够,剩下的就交给AI。

未来谁又说得准呢?

先简单写这么多,此文章仅限一个随笔,语言不够精准,只求尽快完成。

祝前程似锦

此作者没有提供个人介绍。
最后更新于 2026-07-12