SW-VML:基于神威蓝光处理器的向量数学软件包
文献类型:会议论文
作者 | 解庆春 ; 张云泉 ; 鲁永泉 ; 李焱 ; 杨飞 ; 王靖 |
出版日期 | 2013 |
会议名称 | 2013全国高性能计算学术年会 |
会议日期 | 2013 |
会议地点 | 桂林 |
关键词 | SIMD扩展 神威处理器SW_1600 向量数学库 向量化 |
页码 | 1-11 |
中文摘要 | 首先,本文介绍了SIMD扩展技术,并分析了使用SIMD扩展的三种万式,认为通过调用特定目标平台优化的第三万库是应用领域软件开发者快速开发高效并行程序的较好的万式:其次,介绍了国产神威处理嚣SW-1600平台,并利用Sl MD扩展和循环展开等技术开发了SW-VML(SW Vector Math Library),开发过程中提出了访存对界、简化向量条件分支的优化万法,解决了非对界访存、向量与标量数组转换影响性能的问题,并根据sw编译嚣对0penMP的支持,开发了多线程0penMp版.最后,在sw_1600平台上采用不同向量规模对SW-VML进行了测试,测试鲒果显示Sl MD向量化相对于串行程序加速比为2.08,4线程相对单线程平均加速比为2,26.SW-VML是国产神威系列处理嚣上开发的常用向量函数软件包,SW-VML可以用作在神威蓝光高性能计算平台开发高性能程序的基础软件工具包. |
语种 | 中文 |
源URL | [http://ir.iscas.ac.cn/handle/311060/16565] ![]() |
专题 | 软件研究所_软件所图书馆_会议论文 |
推荐引用方式 GB/T 7714 | 解庆春,张云泉,鲁永泉,等. SW-VML:基于神威蓝光处理器的向量数学软件包[C]. 见:2013全国高性能计算学术年会. 桂林. 2013. |
入库方式: OAI收割
来源:软件研究所
浏览0
下载0
收藏0
其他版本
除非特别说明,本系统中所有内容都受版权保护,并保留所有权利。