hi_heige
26-04-23 22:21

《Synthesizing Multi-Agent Harnesses for Vulnerability Discovery》 http://t.cn/AXxNt7Js

对象:Chrome
模型:Kimi K2.5
硬件:使用了 24 个节点,每个节点配备 8 张 H100 GPU,总计使用了 192 张 H100 GPU
Agent:http://t.cn/AXxNt7JF (不是纯粹的代码审计)
时间:7 天

结果:10 个漏洞

其实很多时候也不要去纠结啥 Claude Mythos,其他模型其实也是可以的 LLM在漏洞挖掘领域的应用很早就证明过了,不过 Token 自由还是要面临的一个问题。

我前面基本上都闭环测试过,只是 token 烧起来那也真是肉疼~~

发布于 美国