SW-VML:基于神威蓝光处理器的向量数学软件包
首先,本文介绍了SIMD扩展技术,并分析了使用SIMD扩展的三种方式,认为通过调用特定目标平台优化的第三方库是应用领域软件开发者快速开发高效并行程序的较好的方式:其次,介绍了国产神威处理器SW-1600平台,并利用SIMD扩展和循环展开等技术开发了SW-VML(SW Vector Math Library),开发过程中提出了访存对界、简化向量条件分支的优化方法,解决了非对界访存、向量与标量数组转换影响性能的问题,并根据SW编译器对0penMP的支持,开发了多线程0penMp版.最后,在SW-1600平台上采用不同向量规模对SW-VML进行了测试,测试结果显示SIMD向量化相对于串行程序加速比为2.08,4线程相对单线程平均加速比为2,26.SW-VML是国产神威系列处理器上开发的常用向量函数软件包,SW-VML可以用作在神威蓝光高性能计算平台开发高性能程序的基础软件工具包.
向量数学软件包 神威蓝光处理器 单指令多数据流 性能测试
解庆春 张云泉 鲁永泉 李焱 杨飞 王靖
中国传媒大学高性能计算中心,北京100024;中国科学院软件研究所并行软件与计算科学实验室,北京100190 中国传媒大学高性能计算中心,北京100024;中国科学院计算技术研究所计算机体系结构国家重点实验室,北京100190 中国传媒大学高性能计算中心,北京100024 中国科学院软件研究所并行软件与计算科学实验室,北京100190
国内会议
桂林
中文
1-11
2013-10-29(万方平台首次上网日期,不代表论文的发表时间)