国内刊号:51-1196/TP
国际刊号:1001-3695
发布日期:
作者:吴江雨,何鹏,
单位:湖北大学a.计算机与信息工程学院;b.网络空间安全学院;c.智能感知系统与安全教育部重点实验室,武汉430062;
关键词:SM4,CUDA,GPU加速,比特切片,性能优化,
基金:湖北省重大攻关项目(2023BAA018);武汉市重点研发计划资助项目(2023010402010783);;
SM4算法作为中国国家标准的对称加密算法,其加密效率是实现高质量、高效率数据保护的关键因素。目前SM4算法优化主要表现在比特切片和指令集优化等方面。比特切片和指令集优化分别存在着数据交互频繁以及高度依赖于底层硬件,不同架构的支持程度存在不同的问题。针对上述问题,提出了在数据处理上采用改进的比特切片优化数据编排的方法,从而提高数据传输效率,并且在CUDA编程模型的框架上,通过本地GPU实现SM4算法的高效通用并行加密。实验结果表明,在使用比特切片后,对小型数据也能够提高速度,处理明文大小为32 KB时加速比(Ep)能达到3.03。另外,与通用SM4算法相比,优化后的SM4算法加密速度可以达到14 648 Mbit/s,加密每字节需要的时钟周期可以达到2.0 cycles/Byte,性能提升40%~215%。该方案在GPU的并行加速下能够大大提升当前SM4算法的加解密效率,在基于改进的比特切片优化下,也能提高小型数据的速度,并且安全性得到了良好的提升。
来源:2025年第9期
《计算机应用研究》期刊编辑部