hi_heige
25-10-31 16:53

OpenAI’s agentic security researcher Aardvark

http://t.cn/AXAqeFrt

目前只是个介绍,处于Beta私测阶段,当然OpenAI也象征性的开了个Beta测试申请,估计跟之前Goolge Codemender的差不多 :https://deepmind.google/discover/blog/introducing-codemender-an-ai-agent-for-code-security/ 同样只是个介绍,没有具体的东西可以看,从他们发布的介绍里架构图感觉是差不多的。

在我2023年的尝试,大模型在代码审计等角度上的应用是没有太大的问题的,只是在某些漏洞模型上可能覆盖度还是不那么全,之前我测试过通过Cursor/WindSurf等IDE来做代码审计非常方便。所以其实我对Aardvark还是Codemender没有太大的期待的...

相比之下我比较关注The Big Sleep Team的东西(Big Sleep Team = Google Project Zero + DeepMind 联合战队),大概是去年10月份有官宣过:http://t.cn/A6nNYHmn Naptime项目发展成为Big Sleep, 顺带用一个SQLite的漏洞开篇。

今天看到在IssueTracker上看到Big Sleep的战绩还是比较惊人的:http://t.cn/AXAc7Qic

LLM + 源码 + Fuzzing 套路应该还是很有搞头的

发布于 湖南