国内刊号:51-1196/TP
国际刊号:1001-3695
发布日期:
作者:袁子龙,吴秋新,刘韧,秦宇,
单位:1.北京信息科技大学理学院,北京100192;2.北京卓识网安技术股份有限公司,北京100192;3.中国科学院软件研究所可信计算与信息保障实验室,北京100190;
关键词:语法语义,改进差分进化,漏洞检测,BiGRU,
基金:国家自然科学基金资助项目(61872343);;
源码漏洞检测作为重要的研究课题,其传统方法在面对规模庞大、脆弱性多样化的代码时,存在人工参与度高、未知漏洞检测能力弱等诸多问题。针对以上问题,基于开放源代码的语法语义信息,提出了改进差分进化算法的源码漏洞检测模型冷启动优化方法。运用源码切片技术、启发式优化算法及神经网络模型,解决了漏洞检测模型在启动之初超参数无法准确选定的问题。对于实验中样本信息冗余和正负样本鲜明特征混和的情况,提出了正负样本鲜明特征交叉剔除的思想以减小模型的漏报率及误报率。实验表明,该方法可以有效加速模型的收敛,使得模型在10个epoch内达到稳定,在提升源码漏洞检测模型准确率的同时其收敛速度比其他模型提升了2~3倍。在后续改进实验中,源码漏洞检测模型在所有类型漏洞的准确率上均提高了1~3个百分点,充分证明了改进措施的有效性。该方法的优化策略和改进措施同样适用于其他神经网络分类模型,可以为漏洞检测领域探索新方法和新模型提供思路。
来源:2023年第7期
《计算机应用研究》期刊编辑部