Icebound

icebound-area

近期模型使用体验 (更新至9月)

注意:模型迭代非常快,此文具有时效性

9月更新:

gpt 6-astra:人上人。贵,太贵了,用不起。全能模型,各方面感觉不到短板,找bug能力极强,中文表达顺畅。如果打5折可以给到夯。


gpt 5.6-sol:npc。纯伪人,你跟他说『不要A』,他回答:好的,不要A,现在编写一个单测,拦截所有未来可能出现的A,并且在所有注释和文档里写上『一定不要出现A』。

READ MORE →

五个问题看出差距:Deepseek R1在推理、数学、代码能力上逊于OpenAI O1

通过对deepseek r1测试得到结论:不要沸腾,谨慎乐观,deepseek r1在推理能力和代码能力上远逊于openai o1。

测试方式:通过5个问题,分别询问deepseek r1和openai o1。

模型:o1使用的是国内某proxy的共享账号,r1使用deepseek官网。

原创说明:本文同步发表于知乎和小红书,为了防止被冲烂,在这备份一份。

READ MORE →