意义不大,medium以下就是个快速对话模型,不堪大用,high以上又有雷霆大思考的毛病,靠堆时间提升Agent能力,尤其是Max档位,额度消耗直逼Fable5.1。不管什么任务都不如直接opus5.5来得实在。
没必要 看官方跑分表都能看出端倪
大概率 $/task 不如opus5.5
不值得。但是对于一些风控类的(比如臭搞生物的)就没办法,只能用sonnet 5.5
这样,opus5.5真的很爽!最近最有感觉的一个模型
隔壁讨论的可能多一点
意义不大,medium以下就是个快速对话模型,不堪大用,high以上又有雷霆大思考的毛病,靠堆时间提升Agent能力,尤其是Max档位,额度消耗直逼Fable5.1。不管什么任务都不如直接opus5.5来得实在。