RecodeX 重构消息,8月5日,安全公司Aikido发布代码审计Agent评测,涉及Qwen3.8-Max、Claude Opus5、Kimi K3 Max、DeepSeek V4 Flash及GPT-5.6 Sol等7款模型,测试覆盖32个近期公开漏洞,每款运行3轮。Qwen3.8-Max三轮共识别26个漏洞,召回率81.3%,与Opus5并列第一;F1综合分83.2%,略低于Opus5、Kimi K3 Max和GPT-5.6 Sol。其单轮稳定性不足,仅10个漏洞连续三轮检出,而Opus5和Sol均为19个。总成本约821美元,为Opus5和Sol的一半,是DeepSeek V4 Flash的5倍。