自从爆了一堆蒸馏,路由,偷代码的事情以后,国模都没有高性能模型了,全是降本增效的模型 没国模的监督O/开始不当人了啊,快给奥特曼上点强度吧
卡脖子了
问题来了,靠哪家呢
卡不够了,越往后走,模型越大,对卡的需求越大,这是根本问题,都在等卡,K3 短暂到达过,其实也才2、3个月。
真实原因我猜是,gpt自从推出6也开始加大力度限流风控了,一大堆国模没法蒸馏进步了
@kodeng #3 k3说实话还是目前国模最好用的,ds和glm都比不了,我跑逻辑性的改动国模就只用k3了
肯定能找到办法蒸的,别着急,过半年差不多春节估计就有了
国模现在最好是mimo你敢信
除了美国没有比国模强
@diead #5 K3 比他们两大太多了,v4.1 flash 才几百B
@coldsword #4 GPT6 是最近才出的,这个现象都已经快2个月了。 deepseek 因为V4 FLASH 调用量太大,甚至涨价十几倍来降压力,很明显卡严重不够了。
卡脖子了
问题来了,靠哪家呢
卡不够了,越往后走,模型越大,对卡的需求越大,这是根本问题,都在等卡,K3 短暂到达过,其实也才2、3个月。
真实原因我猜是,gpt自从推出6也开始加大力度限流风控了,一大堆国模没法蒸馏进步了
@kodeng #3 k3说实话还是目前国模最好用的,ds和glm都比不了,我跑逻辑性的改动国模就只用k3了
肯定能找到办法蒸的,别着急,过半年差不多春节估计就有了
国模现在最好是mimo你敢信
除了美国没有比国模强
@diead #5
K3 比他们两大太多了,v4.1 flash 才几百B
@coldsword #4
GPT6 是最近才出的,这个现象都已经快2个月了。
deepseek 因为V4 FLASH 调用量太大,甚至涨价十几倍来降压力,很明显卡严重不够了。