注意:模型迭代非常快,此文具有时效性
9月更新:
gpt 6-astra:人上人。贵,太贵了,用不起。全能模型,各方面感觉不到短板,找bug能力极强,中文表达顺畅。如果打5折可以给到夯。
gpt 5.6-sol:npc。纯伪人,你跟他说『不要A』,他回答:好的,不要A,现在编写一个单测,拦截所有未来可能出现的A,并且在所有注释和文档里写上『一定不要出现A』。
注意:模型迭代非常快,此文具有时效性
gpt 6-astra:人上人。贵,太贵了,用不起。全能模型,各方面感觉不到短板,找bug能力极强,中文表达顺畅。如果打5折可以给到夯。
gpt 5.6-sol:npc。纯伪人,你跟他说『不要A』,他回答:好的,不要A,现在编写一个单测,拦截所有未来可能出现的A,并且在所有注释和文档里写上『一定不要出现A』。
通过对deepseek r1测试得到结论:不要沸腾,谨慎乐观,deepseek r1在推理能力和代码能力上远逊于openai o1。
测试方式:通过5个问题,分别询问deepseek r1和openai o1。
模型:o1使用的是国内某proxy的共享账号,r1使用deepseek官网。
原创说明:本文同步发表于知乎和小红书,为了防止被冲烂,在这备份一份。
READ MORE →