我发现agent写出来的东西能用是能用,bug多来几轮对话也能改,就是漏洞特别多,我让agent A开发软件,然后让 agent B爆破,agent B一会儿就爆破进来了,于是我回去让agent A修,修完再让agent C爆破,agent C一会儿又扫出一堆洞,搞得我写出来的小玩意儿只敢自己用,不敢放公网,大佬们有什么解决方案吗?
我发现agent写出来的东西能用是能用,bug多来几轮对话也能改,就是漏洞特别多,我让agent A开发软件,然后让 agent B爆破,agent B一会儿就爆破进来了,于是我回去让agent A修,修完再让agent C爆破,agent C一会儿又扫出一堆洞,搞得我写出来的小玩意儿只敢自己用,不敢放公网,大佬们有什么解决方案吗?
慢慢迭代了,不然怎么会有内测,公测
GitHub 上面有开源的项目, 模拟其他用户用 AI 攻击你的软件,然后去找你的 bug。你用这个开源的项目模拟测试一下,让它产生一幅报告,你看看就行了
换个ai扫 再人工核对
这个问题等效于“软件如何扫漏洞”
A写B爆这套循环挺有意思,修完记得让B再爆一轮,看能不能收敛
黑盒加白盒多测试几轮,提高攻击难度。尤其是关注前台无需登录态的接口