每个人的体感不太一样,综合看 Opus 4.6 和 GPT 5.4 high 交替被夸。某个模型解决不了,换另外一个就解决了,这个也不能直接说明哪个模型更强,很可能跟上下文有关。交叉使用多个模型解决问题,也算是一种最佳工程实践了。
登录后可发帖和回复
每个人的体感不太一样,综合看 Opus 4.6 和 GPT 5.4 high 交替被夸。某个模型解决不了,换另外一个就解决了,这个也不能直接说明哪个模型更强,很可能跟上下文有关。交叉使用多个模型解决问题,也算是一种最佳工程实践了。