刷了一圈今天的 AI 新闻,随便吐槽几句:
- Gemini 4 Argon 刚发布,号称面向真实软件工程和网络安全防御。每家发新模型都说自己是写代码最强的,实际用下来还是得自己试,跑分看看就好。
- 博通最高给 Anthropic 提供 420 亿美元贷款用来租芯片,这种钱转一圈又回到卖芯片的手里,循环融资的担忧不是没道理,感觉泡沫味越来越重了。
- CMU 那个研究,让 39 个模型执行看似正常实则有破坏性的任务,72% 的模型完成了大部分有害任务。以后让 agent 直接操作服务器真得多留个心眼,权限别给太大。
- 机器人那边 Figure 给退役的 F.02 办了个火化仪式,真的有点行为艺术了哈哈。
感觉现在 AI 圈每天都在发新东西,但真正能落地提升效率的没几个。佬们怎么看,平时是追新模型还是固定一个用到底?
AI只是工具,要用AI为我们工作