复旦白泽AI漏洞攻防全球第二,全量测试中模型调用总成本不足5000元人民币

8月13日,国际AI安全基准测试平台CyberGym发布最新榜单,复旦大学团队研发的白泽智能体Whitzard以91.2%的真实漏洞攻防成功率位列全球第二,同时是全球排名最高的高校团队。

这份榜单的测试覆盖188个大型开源项目的1507个真实漏洞,要求智能体在完整代码库中自主完成漏洞定位、攻击构造和验证。最新版本的白泽智能体成功攻克其中1374个漏洞,排名超过Anthropic面向网络安全打造的前沿模型Claude Mythos。同样被甩在后面的还有微软、Google旗下Wiz等国际头部团队。此前白泽智能体的成绩是68.9%,经对推理机制和验证环节迭代优化后,最新版本将成功率提升至91.2%。

在技术路线上,这支团队的选择和多数参赛者不太一样。据央视新闻报道,该团队采用自主研发的模块化框架,仅调用单个基础模型,通过将程序运行中的路径可达性等转化为推理约束,实现精准收敛。

全量测试中,模型调用总成本不足5000元人民币。

相关智能体框架和评测基准已经开源。

市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

关键词阅读:科技财经资讯风格

责任编辑:磐石
AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开
精彩推荐
加载更多
全部评论
热榜
关闭 下载金融界app
金融界App
金融界微博
金融界公众号