期刊导航
期刊开放获取
cqvip
退出
期刊文献
+
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
检索
高级检索
期刊导航
共找到
1
篇文章
<
1
>
每页显示
20
50
100
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
显示方式:
文摘
详细
列表
相关度排序
被引量排序
时效性排序
基于FPGA的Cholesky分解细粒度并行结构与实现
被引量:
4
1
作者
郭磊
唐玉华
+1 位作者
周杰
董亚卓
《计算机研究与发展》
EI
CSCD
北大核心
2011年第S1期258-265,共8页
基于FPGA平台研究大规模矩阵Cholesky分解的细粒度并行结构与实现.首先在数据依赖关系分析的基础上,提出了Cholesky分解细粒度并行算法,然后提出了可扩展的一维线性阵列结构实现该并行算法.最后在设计的开发板上实现了单精度浮点Cholesk...
基于FPGA平台研究大规模矩阵Cholesky分解的细粒度并行结构与实现.首先在数据依赖关系分析的基础上,提出了Cholesky分解细粒度并行算法,然后提出了可扩展的一维线性阵列结构实现该并行算法.最后在设计的开发板上实现了单精度浮点Cholesky分解阵列处理器.综合结果表明,单个Xilinx Virtex5 XC5VLX330FF1760 FPGA芯片可集成32个处理单元.与运行在2.50GHz Pentium微处理器上的串行C代码相比,该阵列处理器取得最大104.413倍和平均78.789倍的性能加速.
展开更多
关键词
CHOLESKY分解
FPGA
细粒度并行
线性阵列处理器
单
精
浮点
下载PDF
职称材料
题名
基于FPGA的Cholesky分解细粒度并行结构与实现
被引量:
4
1
作者
郭磊
唐玉华
周杰
董亚卓
机构
国防科学技术大学并行与分布计算重点实验室
中国人民解放军
出处
《计算机研究与发展》
EI
CSCD
北大核心
2011年第S1期258-265,共8页
基金
国家自然科学重点基金项目(60921062
60903057)
文摘
基于FPGA平台研究大规模矩阵Cholesky分解的细粒度并行结构与实现.首先在数据依赖关系分析的基础上,提出了Cholesky分解细粒度并行算法,然后提出了可扩展的一维线性阵列结构实现该并行算法.最后在设计的开发板上实现了单精度浮点Cholesky分解阵列处理器.综合结果表明,单个Xilinx Virtex5 XC5VLX330FF1760 FPGA芯片可集成32个处理单元.与运行在2.50GHz Pentium微处理器上的串行C代码相比,该阵列处理器取得最大104.413倍和平均78.789倍的性能加速.
关键词
CHOLESKY分解
FPGA
细粒度并行
线性阵列处理器
单
精
浮点
Keywords
cholesky decomposition
FPGA
fine-grained parallel
linear array processor
single precision floating-point
分类号
TP3 [自动化与计算机技术—计算机科学与技术]
下载PDF
职称材料
题名
作者
出处
发文年
被引量
操作
1
基于FPGA的Cholesky分解细粒度并行结构与实现
郭磊
唐玉华
周杰
董亚卓
《计算机研究与发展》
EI
CSCD
北大核心
2011
4
下载PDF
职称材料
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
上一页
1
下一页
到第
页
确定
用户登录
登录
IP登录
使用帮助
返回顶部