期刊文献+
共找到25篇文章
< 1 2 >
每页显示 20 50 100
Multi-Core Parallel Based Polarimetric InSAR Data Processing Method and Application Cases 认领 引用
1
作者 Lin Liu Yuyang Zheng +4 位作者 Wanwu Li Yan Zhang Xiutao Tang Zenghui Pang Ligang Jia 《Journal of Beijing Institute of Technology》 EI CAS 2026年第3期292-305,共14页
Based on analyzing the storage structure of polarimetric interferometry synthetic aperture radar(Pol-InSAR)data,this study proposed a multi-core parallel Pol-InSAR data processing method(MCP-PIDPM).In order to improve... Based on analyzing the storage structure of polarimetric interferometry synthetic aperture radar(Pol-InSAR)data,this study proposed a multi-core parallel Pol-InSAR data processing method(MCP-PIDPM).In order to improve the processing speed of Pol-InSAR data,this paper presented a multi-core parallel Pol-InSAR data processing scheme,and constructed its processing framework in the research.The key technology of the multi-core parallel Pol-InSAR data processing was discussed,a buffer detection splitting method for Pol-InSAR image was proposed,and improved the self-adaptive phase unwrapping method.At last,a multi-core parallel Pol-InSAR data processing system(MCP-PIDPS)was developed,and the proposed MCP-PIDPM method was tested and validated through experiments.The system based on the above method assigns tasks and loads reasonably to each processor and uses space to exchange time.It is proved by numerical experiments that the efficiency of Pol-InSAR data processing is increased by more than 10 times.The research breaks through the bottleneck which restricts the efficient application of Pol-InSAR,and provides a feasible solution for the efficient processing of Pol-InSAR data. 展开更多
关键词 InSAR polarimetric InSAR DEM parallel computing open multi-processing
暂未订购 下载PDF
基于OpenCL的图像灰度化并行算法研究 认领 引用 被引量:11
2
作者 肖汉 郭宝云 +1 位作者 李彩林 肖诗洋 《江西师范大学学报(自然科学版)》 CAS 北大核心 2020年第5期462-471,共10页
随着图像数据量的增加,传统单核处理器或多处理器结构的计算方式已无法满足图像灰度化实时处理需求.该文利用图像处理器(GPU)在异构并行计算的优势,提出了基于开放式计算语言(OpenCL)的图像灰度化并行算法.通过分析加权平均图像灰度化... 随着图像数据量的增加,传统单核处理器或多处理器结构的计算方式已无法满足图像灰度化实时处理需求.该文利用图像处理器(GPU)在异构并行计算的优势,提出了基于开放式计算语言(OpenCL)的图像灰度化并行算法.通过分析加权平均图像灰度化数据处理的并行性,对任务进行了层次化分解,设计了2级并行的并行算法并映射到“CPU+GPU”异构计算平台上.实验结果显示:图像灰度化并行算法在OpenCL架构下NVIDIA GPU计算平台上相比串行算法、多核CPU并行算法和CUDA并行算法的性能分别获得了27.04倍、4.96倍和1.21倍的加速比.该文提出的并行优化方法的有效性和性能可移植性得到了验证. 展开更多
关键词 图像灰度化 加权平均 图形处理器 开放式计算语言 并行算法
暂未订购 下载PDF
基于异构平台的图像中值滤波的OpenCL加速算法 认领 引用 被引量:10
3
作者 肖诗洋 王镭 +1 位作者 杜莹 肖汉 《河北大学学报(自然科学版)》 CAS 北大核心 2024年第1期92-103,共12页
图像噪声降低了图像信噪比和质量,去噪是图像处理工作的重要环节之一.本文提出了一种基于开放式计算语言(OpenCL)架构的图像中值滤波快速降噪并行算法.介绍了OpenCL体系结构特点和中值滤波处理流程.根据图形处理器(GPU)的并发结构特点,... 图像噪声降低了图像信噪比和质量,去噪是图像处理工作的重要环节之一.本文提出了一种基于开放式计算语言(OpenCL)架构的图像中值滤波快速降噪并行算法.介绍了OpenCL体系结构特点和中值滤波处理流程.根据图形处理器(GPU)的并发结构特点,对图像中值滤波功能模块进行了并行优化,降低了算法复杂度.通过充分激活NDRange索引空间中的工作组和工作项来提高数据访问效率,优化内核工作组配置参数,实现了中值滤波器的并行处理.实验结果表明,在图像质量保持不变的情况下,与基于CPU的串行算法、基于开放多处理(OpenMP)并行算法和基于统一计算设备架构(CUDA)并行算法性能相比,图像中值滤波并行算法在OpenCL架构下NVIDIA GPU计算平台上分别获得了29.74、17.29、1.15倍的加速比.验证了算法的有效性和平台的可移植性,基本满足应用的实时性处理要求. 展开更多
关键词 中值滤波 椒盐噪声 图形处理器 开放式计算语言 并行算法
暂未订购 下载PDF
异构平台上基于OpenCL的矩阵乘并行算法 认领 引用 被引量:3
4
作者 肖汉 肖诗洋 +1 位作者 李彩林 周清雷 《西南大学学报(自然科学版)》 CAS CSCD 北大核心 2020年第11期147-153,共7页
在分析开放式计算语言(OpenCL)平台底层硬件构架的基础上,从数据本地化、计算资源利用率和访存带宽利用率等多个不同角度优化了矩阵乘算法,并实现了矩阵乘算法在OpenCL架构下的加速.实验数据显示,与基于CPU的单线程算法、基于OpenMP多... 在分析开放式计算语言(OpenCL)平台底层硬件构架的基础上,从数据本地化、计算资源利用率和访存带宽利用率等多个不同角度优化了矩阵乘算法,并实现了矩阵乘算法在OpenCL架构下的加速.实验数据显示,与基于CPU的单线程算法、基于OpenMP多线程算法和基于统一计算设备架构(CUDA)并行算法相比,基于OpenCL架构的矩阵乘并行算法效率更高. 展开更多
关键词 矩阵乘 图形处理器 开放式计算语言 并行算法
暂未订购 下载PDF
基于OpenCL的尺度不变特征变换算法的并行设计与实现 认领 引用 被引量:3
5
作者 许川佩 王光 《计算机应用》 CSCD 北大核心 2016年第7期1801-1806,共6页
针对尺度不变特征变换(SIFT)算法实时性差的问题,提出了利用开放式计算语言(Open CL)并行优化的SIFT算法。首先,通过对原算法各步骤进行组合拆分、重构特征点在内存中的数据索引等方式对原算法进行并行化重构,使得算法的中间计算结... 针对尺度不变特征变换(SIFT)算法实时性差的问题,提出了利用开放式计算语言(Open CL)并行优化的SIFT算法。首先,通过对原算法各步骤进行组合拆分、重构特征点在内存中的数据索引等方式对原算法进行并行化重构,使得算法的中间计算结果能够完全在显存中完成交互;然后,采用复用全局内存对象、共享局部内存、优化内存读取等策略对原算法各步骤进行并行设计,提高数据读取效率,降低传输延时;最后,利用Open CL语言在图形处理单元(GPU)上实现了SIFT算法的细粒度并行加速,并在中央处理器(CPU)上完成了移植。与原SIFT算法配准效果相近时,并行化的算法在GPU和CPU平台上特征提取速度分别提升了10.51~19.33和2.34~4.74倍。实验结果表明,利用Open CL并行加速的SIFT算法能够有效提高图像配准的实时性,并能克服统一计算设备架构(CUDA)因移植困难而不能充分利用异构系统中多种计算核心的缺点。 展开更多
关键词 尺度不变特征变换算法 开放式计算语言 复用内存对象 细粒度并行 异构系统
暂未订购 下载PDF
基于开源程序的大跨桥梁模型更新 认领 引用 被引量:3
6
作者 郑俊浩 王达荣 +1 位作者 管仲国 林楷奇 《工程力学》 EI CSCD 北大核心 2025年第3期181-190,共10页
大跨桥梁作为重要的基础工程设施,准确评估其即时服役状态、建立高保真数值模型是提升城市交通防灾水平的重要途径,实现上述目标依赖于高效可靠的复杂结构模型更新与分析技术。但已有研究多依赖商业软件平台,存在价格昂贵、算法更新速... 大跨桥梁作为重要的基础工程设施,准确评估其即时服役状态、建立高保真数值模型是提升城市交通防灾水平的重要途径,实现上述目标依赖于高效可靠的复杂结构模型更新与分析技术。但已有研究多依赖商业软件平台,存在价格昂贵、算法更新速度较慢和软件接口复杂等局限性,限制了相关研究的深入发展。因此,该文基于开源有限元分析平台OpenSees和编程语言Python,开发了适用于复杂工程结构模型更新的开源程序框架。基于Python开发了工程结构模型更新所需的高效并行优化算法,进一步编写不同功能模块的软件接口,连接模型分析平台与并行优化算法,实现复杂工程结构模型的并行分析和模型更新。在此基础上,以一个简支梁损伤识别为例,验证了上述计算程序的有效性与计算精度。以苏通大桥振动台试验缩尺模型为研究对象,采用模态置信准则匹配有限元模型和振动台试验获得的模态振型和频率数据,构建模型更新所需的优化函数,采用高性能计算平台,开展试验桥梁的模型更新并验证上述程序框架的计算效率。结果表明,该框架可以实现大跨斜拉桥精细有限元模型的高效更新,匹配实测获得的结构模态数据,各阶计算频率与试验模型的误差在1%以下。进一步地,计算更新后的数值模型在PGA=0.1 g地震动作用下的动力时程响应,与试验数据对比验证了模型更新结果的准确性。研究成果可以为基于开源平台的复杂大跨桥梁的精细化与数据驱动建模提供参考。 展开更多
关键词 开源程序框架 并行优化算法 大跨度桥梁 精细化有限元模型 模型更新
暂未订购 下载PDF
On Numerical methods for determination of Earth gravity field model using mass satellite gravity gradiometry data 认领 引用
7
作者 Zhu Guangbin Chang Xiaotao +2 位作者 Li Xinfa Zhang Xinhang Li Yuxing 《Geodesy and Geodynamics》 2012年第1期57-62,共6页
On the basis of Space-Wise Least Square method, three numerical methods including Cholesky de- composition, pre-conditioned conjugate gradient and Open Multi-Processing parallel algorithm are applied into the determin... On the basis of Space-Wise Least Square method, three numerical methods including Cholesky de- composition, pre-conditioned conjugate gradient and Open Multi-Processing parallel algorithm are applied into the determination of gravity field with satellite gravity gradiometry data. The results show that, Cholesky de- composition method has been unable to meet the requirements of computation efficiency when the computer hardware is limited. Pre-conditioned conjugate gradient method can improve the computation efficiency of huge matrix inversion, but it also brings a certain loss of precision. The application of Open Multi-Processing parallel algorithm could achieve a good compromise between accuracy and computation efficiency. 展开更多
关键词 satellite gravity gradiometry Cholesky decomposition pre-conditioned conjugate gradient open multi-processing parallel algorithm data processing
暂未订购 下载PDF
认知无线电中的并行频谱分配算法 认领 引用 被引量:59
8
作者 廖楚林 陈劼 +1 位作者 唐友喜 李少谦 《电子与信息学报》 EI CAS 北大核心 2007年第7期1608-1611,共4页
该文通过对基于图论着色原理的开放式频谱分配算法的分析,提出了一种并行分配算法。在最大化系统效益的准则下,并行算法可以得到与CSGC(Color Sensitive Graph Coloring)算法相同的分配矩阵,但是却可以缩短分配周期,从而适应了认知无线... 该文通过对基于图论着色原理的开放式频谱分配算法的分析,提出了一种并行分配算法。在最大化系统效益的准则下,并行算法可以得到与CSGC(Color Sensitive Graph Coloring)算法相同的分配矩阵,但是却可以缩短分配周期,从而适应了认知无线电对环境的快速感知的要求。仿真结果分析验证了结论的正确性。 展开更多
关键词 认知无线电 开放式频谱分配 图论着色 并行算法
暂未订购 下载PDF
平行机及自由作业的排序与转包 认领 引用 被引量:5
9
作者 陈荣军 张峰 唐国春 《系统工程学报》 CSCD 北大核心 2011年第5期649-655,共7页
研究工件排序与转包相联的模型,即制造商从客户处接受一批工件,这些工件既可以由制造商加工,也可以一定费用转包给承包商加工.制造商需要确定被转包的工件集及工件的加工顺序,使得加工费用和转包费用之和为最小.研究制造商为平行机及自... 研究工件排序与转包相联的模型,即制造商从客户处接受一批工件,这些工件既可以由制造商加工,也可以一定费用转包给承包商加工.制造商需要确定被转包的工件集及工件的加工顺序,使得加工费用和转包费用之和为最小.研究制造商为平行机及自由作业,承包商为单机情况下的排序与转包模型,基于动态规划算法给出了近似算法,并分析了该算法的性能比. 展开更多
关键词 排序 转包 近似算法 平行机 自由作业
暂未订购 下载PDF
CPU+GPU异构并行的矩阵转置算法研究 认领 引用 被引量:4
10
作者 肖汉 李彩林 +1 位作者 李琦 周清雷 《东北师大学报(自然科学版)》 CAS 北大核心 2019年第4期70-77,共8页
针对当前算法优化研究一般局限于单一硬件平台、很难实现在不同平台上高效运行的问题,利用图形处理器(GPU)提出了基于开放式计算语言(OpenCL)的矩阵转置并行算法.通过矩阵子块粗粒度并行、矩阵元素细粒度并行、工作项与数据的空间映射... 针对当前算法优化研究一般局限于单一硬件平台、很难实现在不同平台上高效运行的问题,利用图形处理器(GPU)提出了基于开放式计算语言(OpenCL)的矩阵转置并行算法.通过矩阵子块粗粒度并行、矩阵元素细粒度并行、工作项与数据的空间映射和本地存储器优化方法的应用,使矩阵转置算法在GPU计算平台上的性能提高了12倍.实验结果表明,与基于CPU的串行算法、基于开放多处理(OpenMP)并行算法和基于统一计算设备架构(CUDA)并行算法性能相比,矩阵转置并行算法在OpenCL架构下NVIDIA GPU计算平台上分别获得了12.26,2.23和1.50的加速比.该算法不仅性能高,而且实现了在不同计算平台间的性能移植. 展开更多
关键词 矩阵转置 图形处理器 开放式计算语言 并行算法
暂未订购 下载PDF
面向异构架构的传递闭包并行算法 认领 引用 被引量:3
11
作者 肖汉 郭宝云 +1 位作者 李彩林 周清雷 《计算机工程》 CAS CSCD 北大核心 2021年第8期131-139,共9页
传统求图传递闭包的方法存在计算量大与计算时间长的问题。为加快处理大数据量的传递闭包算法的计算速度,结合算法密集计算和开放式计算语言(OpenCL)框架的特征,采用本地存储器优化的并行子矩阵乘和分块的矩阵乘并行计算,提出一种基于Op... 传统求图传递闭包的方法存在计算量大与计算时间长的问题。为加快处理大数据量的传递闭包算法的计算速度,结合算法密集计算和开放式计算语言(OpenCL)框架的特征,采用本地存储器优化的并行子矩阵乘和分块的矩阵乘并行计算,提出一种基于OpenCL的传递闭包并行算法。利用本地存储器优化的并行子矩阵乘算法来优化计算步骤,提高图形处理器(GPU)的存储器利用率,降低数据获取延迟。通过分块矩阵乘并行计算算法实现大数据量的矩阵乘,提高GPU计算核心的利用率。数据结果表明,与CPU串行算法、基于开放多处理的并行算法和基于统一设备计算架构的并行算法相比,传递闭包并行算法在OpenCL架构下NVIDIA GeForce GTX 1070计算平台上分别获得了593.14倍、208.62倍和1.05倍的加速比。 展开更多
关键词 矩阵乘 传递闭包 图形处理器 开放式计算语言 并行算法
暂未订购 下载PDF
考虑模具约束和开机成本的并行机调度问题研究 认领 引用 被引量:5
12
作者 李金霖 尹成龙 《运筹与管理》 CSSCI CSCD 北大核心 2024年第4期105-111,共7页
受企业实际的注塑排产问题启发,本文研究了一类考虑模具约束和开机成本的相同并行机调度问题,目标是最小化加权延迟成本、换模成本和开机成本之和。构建了混合整数规划模型,证明了问题必定存在无机器空闲的最优解,提出了新的工作分配规... 受企业实际的注塑排产问题启发,本文研究了一类考虑模具约束和开机成本的相同并行机调度问题,目标是最小化加权延迟成本、换模成本和开机成本之和。构建了混合整数规划模型,证明了问题必定存在无机器空闲的最优解,提出了新的工作分配规则以确保产生的解都无机器空闲。在此基础上,设计了修改的ATCS算法(ATCS-MOD)和基于列表调度的遗传算法(GA-LS)两种算法。大规模数值实验证明GA-LS求解效果优于CPLEX和ATCS-MOD,更显著优于传统ATCS算法,同时也证明了新工作分配规则相比传统ATCS规则的优越性。 展开更多
关键词 并行机调度 模具约束 开机成本 遗传算法
暂未订购 下载PDF
串-并混联式研抛机床的开放式数控系统研究 认领 引用 被引量:7
13
作者 韩霜 赵继 刘志新 《中国机械工程》 EI CAS 北大核心 2007年第16期1913-1916,共4页
以串-并混联式研抛机床为对象,对开放式数控系统进行了研究。设计了将PC机及多轴运动控制卡相结合的数控系统总体结构。基于Windows操作系统,设计了多层式结构的数控系统软件。以Visual C++为开发平台,提出了基于双口RAM的通信机制及两... 以串-并混联式研抛机床为对象,对开放式数控系统进行了研究。设计了将PC机及多轴运动控制卡相结合的数控系统总体结构。基于Windows操作系统,设计了多层式结构的数控系统软件。以Visual C++为开发平台,提出了基于双口RAM的通信机制及两级式插补算法,进行了平面多边形及圆弧轨迹插补试验。试验结果证明该数控系统误差范围小。 展开更多
关键词 串-并混联式研抛机床 开放式数控系统 多层式结构 通信机制 插补算法
暂未订购 下载PDF
基于开放运算语言加速的数字全息卷积重建算法实现 认领 引用 被引量:1
14
作者 罗洪艳 周珞一 +2 位作者 赵震 郭洪 冯晓波 《电子与信息学报》 EI CAS CSCD 北大核心 2022年第9期3258-3265,共8页
针对数字全息重建算法计算速度慢、实时应用能力弱以及现有GPU加速策略跨平台移植性差等问题,该文提出一种利用开放运算语言(OpenCL)架构提高数字全息重建算法执行效率的方案。该方案充分利用OpenCL架构的异构协同计算能力,对数字全息... 针对数字全息重建算法计算速度慢、实时应用能力弱以及现有GPU加速策略跨平台移植性差等问题,该文提出一种利用开放运算语言(OpenCL)架构提高数字全息重建算法执行效率的方案。该方案充分利用OpenCL架构的异构协同计算能力,对数字全息卷积重建算法进行CPU+GPU的异构运行设计,并采用数据并行模式编程实现。针对不同分辨率数字全息图、不同GPU加速平台的测试结果表明,该加速策略的平均执行时间均比CPU低1个数量级,最高总加速比达到54.2,并行运算加速比甚至高达94.7,且具有规模增长性及良好的跨平台特性,加速效率显著,更加适用于数字全息技术的工程化实现及实时性应用场合。 展开更多
关键词 数字全息 重建算法 开放运算语言 并行计算
暂未订购 下载PDF
基于GPU加速的全源对最短路径并行算法 认领 引用 被引量:2
15
作者 肖汉 肖诗洋 +1 位作者 李焕勤 周清雷 《云南大学学报(自然科学版)》 CAS CSCD 北大核心 2023年第5期1022-1032,共11页
针对最短路径算法处理大规模数据集低效的问题,提出了基于图形处理器(Graphics Processing Unit,GPU)加速的全源对最短路径并行算法.首先通过优化矩阵乘法算法实现了在工作组内和组间进行并行运算数据,然后减少了非规则行造成的工作项分... 针对最短路径算法处理大规模数据集低效的问题,提出了基于图形处理器(Graphics Processing Unit,GPU)加速的全源对最短路径并行算法.首先通过优化矩阵乘法算法实现了在工作组内和组间进行并行运算数据,然后减少了非规则行造成的工作项分支,最后降低了工作项对邻接矩阵计算条带存储资源的访问延时.实验结果表明,与基于AMD Ryzen5 1600X CPU的串行算法、基于开放多处理(Open Multi-Processing, OpenMP)并行算法和基于统一计算设备架构(Compute Unified Device Architecture, CUDA)并行算法相比,最短路径并行算法在开放式计算语言(Open Computing Language, OpenCL)架构下NVIDIA GeForce GTX 1 070计算平台上分别获得了196.35、36.76和2.25倍的加速比,验证了提出的并行优化方法的有效性和性能可移植性. 展开更多
关键词 最短路径 重复平方法 图形处理器 开放式计算语言 并行算法
暂未订购 下载PDF
锥束CT图像重建算法的快速实现 认领 引用 被引量:4
16
作者 吴胜利 潘瑞谊 文斌 《CT理论与应用研究(中英文)》 2007年第4期31-37,共7页
本文基于锥束CT滤波反投影重建的FDK算法,通过两种算法改进并结合基于共享内存的OpenMP并行技术和代码优化,实现了锥束CT图像的快速重建。基于锥束CT实际投影数据的重建结果表明,图像重建速度得到了较大的提高,断层图像重建质量与FDK原... 本文基于锥束CT滤波反投影重建的FDK算法,通过两种算法改进并结合基于共享内存的OpenMP并行技术和代码优化,实现了锥束CT图像的快速重建。基于锥束CT实际投影数据的重建结果表明,图像重建速度得到了较大的提高,断层图像重建质量与FDK原型算法相当。 展开更多
关键词 锥束CT 图像重建 FDK滤波反投影法 OpenMP并行技术
暂未订购 下载PDF
海量卫星重力梯度观测数据确定地球重力位模型的数值方法 认领 引用 被引量:1
17
作者 朱广彬 常晓涛 +2 位作者 邹贤才 徐新禹 王建强 《大地测量与地球动力学》 CSCD 北大核心 2011年第6期140-144,共5页
基于空域最小二乘法,对卫星重力梯度数据确定地球重力场中的Cholesky分解法、预条件共轭梯度法以及OpenMP并行算法3种数值方法进行比较与分析。研究表明,在计算机硬件资源有限的情况下,传统的Cholesky分解法已经无法满足求解要求;预条... 基于空域最小二乘法,对卫星重力梯度数据确定地球重力场中的Cholesky分解法、预条件共轭梯度法以及OpenMP并行算法3种数值方法进行比较与分析。研究表明,在计算机硬件资源有限的情况下,传统的Cholesky分解法已经无法满足求解要求;预条件共轭梯度法的求解效率较之Cholesky分解法有改进,但其以损失小量精度为代价;OpenMP并行算法在不损失求解精度的条件下,可提高求解的效率。 展开更多
关键词 卫星重力梯度 Cholesky分解 预条件共轭梯度 OpenMP并行算法 数据处理
暂未订购 下载PDF
开放式计算语言加速的分段前缀和并行算法 认领 引用
18
作者 肖汉 李彩林 +1 位作者 郭宝云 周清雷 《科学技术与工程》 北大核心 2019年第31期215-221,共7页
针对数值计算中前缀和运算数据量大、耗时巨大这一难题,提出了一种基于开放式计算语言(open computing language,OpenCL)的分段式前缀和并行算法。首先进行了分段式前缀和算法的并行性分析,对任务进行了层次化分解与组合,设计了两级并... 针对数值计算中前缀和运算数据量大、耗时巨大这一难题,提出了一种基于开放式计算语言(open computing language,OpenCL)的分段式前缀和并行算法。首先进行了分段式前缀和算法的并行性分析,对任务进行了层次化分解与组合,设计了两级并行的分段式前缀和算法;然后通过OpenCL编程将前缀和并行算法映射到CPU+GPU系统平台上,实现了层次化并行前缀和处理;最后,根据计算单元(compute unit,CU)的资源条件,增加CU中本地存储器的分配,通过改进工作节点的访问模式来降低bank冲突,提高访存速度。实验结果表明,与基于AMD Opteron 2439 SE CPU的串行算法、基于OpenMP(open multi-processing)并行算法和基于统一计算设备架构并行算法性能相比,前缀和并行算法在OpenCL架构下NVIDIA Tesla C2075计算平台上分别获得了33.51倍、6.26倍和2.41倍的加速比。验证了提出的并行优化方法的有效性和性能可移植性。 展开更多
关键词 分段式前缀和 图形处理器 开放式计算语言 并行算法 性能优化
暂未订购 下载PDF
高分三号数据分布式负载均衡并行转换算法 认领 引用
19
作者 邱祥峰 《厦门理工学院学报》 2024年第5期33-39,共7页
针对PolSARpro软件原有高分三号数据转换模块无法适应分布式环境及数据转换效率相对较低的问题,提出一种基于MPI、MapReduce和OpenMP并按照该软件的数据格式要求进行分布式负载均衡的并行转换算法。该算法外层采用MPI按任务分布式计算,... 针对PolSARpro软件原有高分三号数据转换模块无法适应分布式环境及数据转换效率相对较低的问题,提出一种基于MPI、MapReduce和OpenMP并按照该软件的数据格式要求进行分布式负载均衡的并行转换算法。该算法外层采用MPI按任务分布式计算,中间层采用MapReduce按景并行处理,内层采用OpenMP按极化方式并行计算,并采用“Z”字形数据负载均衡策略,将高分三号不同成像模式下的多极化数据快速精确定标及格式转换,以抗数据偏斜。实际数据的测试结果表明,该算法的整体性能提升了约50%,验证了算法的可行性、高效性和正确性。 展开更多
关键词 高分三号卫星 合成孔径雷达 分布式负载均衡 并行转换算法 共享存储并行编程 映射归约编程模型 消息传递接口
暂未订购 下载PDF
基于FPGA的Smith-Waterman算法的加速与实现 认领 引用 被引量:1
20
作者 周智 徐渊 +2 位作者 邓建晖 唐桐升 吴琪 《电子元器件与信息技术》 2019年第7期91-94,共4页
Smith-waterman算法广泛用于生物序列比对中,但是生物序列比对的数据量极大,为了缩短比对时间,减少成本,本文提出了一种高度并行化的smith-waterman算法。此方案不仅优化了序列比对模块,利用FPGA的高度并行运算能力,并且提高了算法总的... Smith-waterman算法广泛用于生物序列比对中,但是生物序列比对的数据量极大,为了缩短比对时间,减少成本,本文提出了一种高度并行化的smith-waterman算法。此方案不仅优化了序列比对模块,利用FPGA的高度并行运算能力,并且提高了算法总的运算速度。由实验结果证明实现的速度可达到294.6GCUPS,优于目前已知的其他设计。同时与常规硬件描述语言编程相比,本文采用OpenCL代码规范进行开发,在CPU+FPGA的异构平台上显著减少了代码量,并缩短了开发时间。 展开更多
关键词 FPGA Smith-Waterman算法 OpenCL 序列比对 并行循环
暂未订购 下载PDF
上一页 1 2 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈