期刊文献+
共找到220篇文章
< 1 2 11 >
每页显示 20 50 100
基于LLVM Pass的复杂嵌套循环自动并行化框架 认领 引用 被引量:4
1
作者 马春燕 吕炳旭 +1 位作者 叶许姣 张雨 《软件学报》 EI CSCD 北大核心 2023年第7期3022-3042,共21页
随着多核处理器的普及应用,针对嵌入式遗留系统中串行代码的自动并行化方法是研究热点.其中,针对具有非完美嵌套结构、非仿射依赖关系特征的复杂嵌套循环的自动并行化方法存在技术挑战.提出了一种基于LLVMPass的复杂嵌套循环的自动并行... 随着多核处理器的普及应用,针对嵌入式遗留系统中串行代码的自动并行化方法是研究热点.其中,针对具有非完美嵌套结构、非仿射依赖关系特征的复杂嵌套循环的自动并行化方法存在技术挑战.提出了一种基于LLVMPass的复杂嵌套循环的自动并行化框架(CNLPF).首先,提出了一种复杂嵌套循环的表示模型,即循环结构树,并将嵌套循环的正则区域自动转换为循环结构树表示;然后,对循环结构树进行数据依赖分析,构建循环内和循环间的依赖关系;最后,基于OpenMP共享内存的编程模型生成并行的循环程序.针对SPEC2006数据集中包含近500个复杂嵌套循环的6个程序案例,分别对其进行复杂嵌套循环占比统计和并行性能加速测试.结果表明,提出的自动并行化框架可以处理LLVMPolly无法优化的复杂嵌套循环,增强了LLVM的并行编译优化能力,且该方法结合Polly的组合优化,比单独采用Polly优化的加速效果提升了9%-43%. 展开更多
关键词 复杂嵌套循环 自动并行化 LLVM Pass 依赖分析
暂未订购 下载PDF
Multi-Deme Parallel FGAs-Based Algorithm for Multitarget Tracking 认领 引用 被引量:1
2
作者 刘虎 朱力立 张焕春 《Journal of Electronic Science and Technology of China》 2006年第1期12-17,共6页
For data association in multisensor and multitarget tracking, a novel parallel algorithm is developed to improve the efficiency and real-time performance of FGAs-based algorithm. One Cluster of Workstation (COW) wit... For data association in multisensor and multitarget tracking, a novel parallel algorithm is developed to improve the efficiency and real-time performance of FGAs-based algorithm. One Cluster of Workstation (COW) with Message Passing Interface (MPI) is built. The proposed Multi-Deme Parallel FGA (MDPFGA) is run on the platform. A serial of special MDPFGAs are used to determine the static and the dynamic solutions of generalized m-best S-D assignment problem respectively, as well as target states estimation in track management. Such an assignment-based parallel algorithm is demonstrated on simulated passive sensor track formation and maintenance problem. While illustrating the feasibility of the proposed algorithm in multisensor multitarget tracking, simulation results indicate that the MDPFGAs-based algorithm has greater efficiency and speed than the FGAs-based algorithm. 展开更多
关键词 multitarget tracking multi-deme Fuzzy Genetic Algorithm (FGA) parallelization Message Passing Interface (MPI)
暂未订购 下载PDF
顶管穿越与并行对既有地铁盾构隧道的影响分析 认领 引用 被引量:4
3
作者 黄建华 袁晓玉 张建昆 《城市轨道交通研究》 北大核心 2025年第3期29-34,共6页
[目的]地下暗挖工程中,隧道相互穿越工况越来越多且复杂,因此迫切需要探究其相互作用和影响机制,旨在把隧道变形控制在合理范围内。[方法]结合顶管穿越既有盾构隧道工程实例,模拟分析顶管穿越与并行施工对既有地铁盾构隧道的影响规律并... [目的]地下暗挖工程中,隧道相互穿越工况越来越多且复杂,因此迫切需要探究其相互作用和影响机制,旨在把隧道变形控制在合理范围内。[方法]结合顶管穿越既有盾构隧道工程实例,模拟分析顶管穿越与并行施工对既有地铁盾构隧道的影响规律并与实测成果验证。[结果及结论]既有隧道变形随着与顶管的距离增大而减小;顶管垂直穿越施工,既有地铁隧道最大变形位于顶管中轴线处;顶管开挖面在距离地铁盾构隧道中轴线12 m范围内,地铁盾构隧道变形最大;顶管并行穿越施工的影响区域主要在顶管开挖面前方20 m和后方10 m范围内。 展开更多
关键词 地铁盾构隧道 顶管 穿越 并行 影响分析
暂未订购 下载PDF
电大涂覆目标SBR算法与MPI并行加速技术 认领 引用 被引量:1
4
作者 吴扬 王思凡 +5 位作者 申子昂 贾浩文 祝强强 徐若锋 郭卿超 赵雷 《电波科学学报》 CSCD 北大核心 2025年第3期407-414,共8页
为满足涂覆雷达吸波材料(radar absorbing material,RAM)的复杂目标电磁散射快速计算需求,提出了一种基于弹跳射线(shooting and bouncing ray,SBR)的高效计算方法。该方法利用广义传播矩阵法理论推导了金属衬底多层介质的反射系数,并... 为满足涂覆雷达吸波材料(radar absorbing material,RAM)的复杂目标电磁散射快速计算需求,提出了一种基于弹跳射线(shooting and bouncing ray,SBR)的高效计算方法。该方法利用广义传播矩阵法理论推导了金属衬底多层介质的反射系数,并将其与SBR法耦合,精确计算了多层介质涂覆目标的雷达散射截面(radar cross section,RCS);为进一步提高计算效率,采用基于CPU平台的MPI并行加速技术,实现了SBR算法的高效并行。数值结果表明:所计算的二面角反射器模型和舰船模型RCS结果与商业软件FEKO结果之间吻合良好,其中二面角反射器的均方根误差小于3 dBsm;针对电大涂覆飞行器目标,各计算进程的并行效率均达到80%以上。该方法有效解决了电大涂覆目标电磁散射计算的精度和速度,为电大复杂目标隐身性能的评估计算提供了高效的解决方案。 展开更多
关键词 弹跳射线(SBR)法 广义传播矩阵法 MPI并行 雷达散射截面(RCS) 雷达吸波材料(RAM)
暂未订购 下载PDF
基于Euler方法的爆炸场大规模数值模拟并行计算策略 认领 引用
5
作者 宁建国 高义 《兵工学报》 EI CAS CSCD 北大核心 2025年第10期1-11,共11页
针对爆炸场数值模拟中的计算规模大和并行效率低的问题,基于Euler方法提出了一种基于分布式共享内存的并行计算策略。该策略通过构建非一致性内存访问架构的集群系统,并结合消息传递接口以及无限宽带高速网络,对pMMIC-3D程序的并行化策... 针对爆炸场数值模拟中的计算规模大和并行效率低的问题,基于Euler方法提出了一种基于分布式共享内存的并行计算策略。该策略通过构建非一致性内存访问架构的集群系统,并结合消息传递接口以及无限宽带高速网络,对pMMIC-3D程序的并行化策略进行了优化,进而提升了程序的大规模计算能力。通过炸药在空中爆炸问题的仿真算例,测试了并行程序的准确性、加速比、并行效率和计算规模,测试结果表明所提出的并行策略准确有效,并显著降低了通信开销且提高了计算效率。此外,为进一步验证该并行策略在复杂场景下的适用性,选用炸药在混凝土建筑结构内部爆炸算例进行测试并与实验结果进行了对比,计算结果表明,该并行策略具备了处理复杂大规模爆炸场数值模拟的能力,适用于实际工程应用。 展开更多
关键词 爆炸场 Euler方法 并行化策略 非一致性内存访问 消息传递接口
暂未订购 下载PDF
基于“天河二号”聚合通信卸载特性的MPI_Barrier优化 认领 引用 被引量:1
6
作者 朱琦 戴艺 +5 位作者 彭晋韬 谢旻 梁崇山 刘鹏 杨博 刘杰 《计算机工程与科学》 CSCD 北大核心 2025年第3期400-411,共12页
Barrier作为消息传递接口MPI程序的基本操作,是确保程序正确执行的重要机制之一。目前已有的Barrier实现方案主要存在2个缺陷:首先,节点间同步存在大量冗余的数据路径传输开销;其次,节点内同步存在大量缓存失效的情况。为解决这些性能限... Barrier作为消息传递接口MPI程序的基本操作,是确保程序正确执行的重要机制之一。目前已有的Barrier实现方案主要存在2个缺陷:首先,节点间同步存在大量冗余的数据路径传输开销;其次,节点内同步存在大量缓存失效的情况。为解决这些性能限制,针对“天河二号”定制网络TH-Express聚合通信卸载特性,提出了基于GLEX NIC的Barrier加速和共享内存标志位重排列2种优化技术,有效减少了节点间同步开销,提高了节点内基于共享内存的同步效率。基于上述优化方法,重新设计了MPI_Barrier算法,并将其集成到MPI通信库中,并在国家超级计算长沙中心通过运行微基准测试程序和实际应用程序对所提优化方法进行性能测试,规模达到7168个节点。实验结果表明,优化后的MPI_Barrier集合操作获得了1.3~14.5倍的加速,并在应用级真实负载评测中,性能提升高达54%。 展开更多
关键词 MPI Barrier 大规模并行应用 NIC聚合通信卸载
暂未订购 下载PDF
基于设施配置完善的双向编组站效能提升研究 认领 引用 被引量:1
7
作者 孙立军 周士超 赵志刚 《铁道运输与经济》 北大核心 2025年第1期171-180,共10页
编组站是枢纽地区的核心车站也是路网运输的支撑点,其设施的完备程度是满足车流作业需求的硬性条件。编组站作业效能是否有效发挥,不仅影响到本站的作业效率,也影响到点、线与路网的运能匹配。以双向编组站为对象,针对复杂走向车流、高... 编组站是枢纽地区的核心车站也是路网运输的支撑点,其设施的完备程度是满足车流作业需求的硬性条件。编组站作业效能是否有效发挥,不仅影响到本站的作业效率,也影响到点、线与路网的运能匹配。以双向编组站为对象,针对复杂走向车流、高密度行车和多项作业同时进行的相互干扰等因素,分析传统三级七场编组站在折角车流交换、机列衔接、线路通过能力等制约车流组织效率的因素。由此提出,随着铁路货运车流量增长和车流结构多样化的快速发展趋势,不应将完善设施的思路局限于编组站站场规模的扩大,而是将枢纽内部各站、线和编组站内部各作业设施视为整体,从畅通相互间的作业联系着手进行完善,实现枢纽地区整体的均衡运输、平行作业,达到点、线与路网运能匹配的效果。 展开更多
关键词 双向编组站 均衡运输 进路交叉 折角车流 平行作业 通过能力
暂未订购 下载PDF
基于MPI的大规模遥感影像金字塔并行构建方法 认领 引用 被引量:25
8
作者 赫高进 熊伟 +2 位作者 陈荦 吴秋云 景宁 《地球信息科学学报》 CSCD 北大核心 2015年第5期515-522,共8页
影像金字塔是实现影像数据多分辨率组织的重要方式,是提高影像可视化性能的有效手段。传统串行金字塔构建算法,对大规模影像数据的构建性能已无法满足遥感影像快速浏览的预处理需求。故此,其成为一个亟待解决的问题,而利用多核、多节点... 影像金字塔是实现影像数据多分辨率组织的重要方式,是提高影像可视化性能的有效手段。传统串行金字塔构建算法,对大规模影像数据的构建性能已无法满足遥感影像快速浏览的预处理需求。故此,其成为一个亟待解决的问题,而利用多核、多节点的高性能集群计算环境和并行机制是一个重要的技术途径。本文在共享外存的高性能集群环境下,提出使用消息传递接口(MPI)的金字塔并行构建算法,对构建遥感影像金字塔过程中的重采样与I/O过程进行并行处理,大大缩短了遥感影像金字塔构建时间。实验结果表明:(1)该算法比传统串行构建方法的加速效果明显,对于单波段遥感影像,其加速效果可达到GDAL的5倍以上,而对于多波段遥感影像,加速效果可达到GDAL的2倍以上;(2)遥感影像数据量越大,并行构建算法加速效果越显著,对于大规模的遥感影像,本文提出的金字塔并行构建算法的速度可达到GDAL的10倍左右。 展开更多
关键词 遥感影像金字塔 消息传递接口 并行 集群
暂未订购 下载PDF
浅埋近距离煤层工作面过平行煤柱开采强矿压显现规律 认领 引用 被引量:7
9
作者 孟永兵 黄庆享 +4 位作者 贺雁鹏 范东林 陈苏社 韦业豪 王君 《西安科技大学学报》 CAS 北大核心 2024年第2期245-255,共11页
浅埋近距离煤层工作面过平行煤柱开采容易发生强矿压压架事故,严重影响工作面安全高效开采。以榆家梁煤矿43207工作面和石圪台煤矿2-2上102及2-2上103工作面为背景,采用理论分析、物理模拟和现场实测相结合的方法,根据间隔岩层厚... 浅埋近距离煤层工作面过平行煤柱开采容易发生强矿压压架事故,严重影响工作面安全高效开采。以榆家梁煤矿43207工作面和石圪台煤矿2-2上102及2-2上103工作面为背景,采用理论分析、物理模拟和现场实测相结合的方法,根据间隔岩层厚度和煤柱应力传递影响角,提出了过煤柱阶段划分判据,重点分析了不同间采比G、水力压裂程度条件下,过平行煤柱不同阶段的矿压显现特征。结果表明:由于上覆遗留煤柱及倒梯形覆岩结构的作用,导致煤柱影响阶段来压时支架平均载荷最大,进煤柱阶段次之,出煤柱阶段最小,强矿压位置主要集中在出煤柱影响阶段范围;间采比越小,工作面过煤柱采动期间来压时支架平均载荷越大,间采比G=5.5较G=10在进煤柱阶段、煤柱影响阶段和出煤柱阶段分别增大14.6%、14.2%和23.5%,动载效应越明显;间采比对周期来压步距影响不大,总体上煤柱影响阶段的周期来压步距是进出煤柱阶段的1.6~2倍,周期来压步距越大造成顶板悬伸长度增大,导致工作面来压时支架载荷明显。根据过煤柱阶段不同水力压裂范围的矿压规律分析,压裂后的支架平均载荷较未压裂减小11.2%~15%,来压步距减小7.8%~20.3%,水力压裂效果较明显,可有效地降低工作面过煤柱采动的强矿压风险,为类似开采条件的强矿压控制提供借鉴意义。 展开更多
关键词 浅埋近距离煤层 过平行煤柱 强矿压显现 间采比 弱化效果
暂未订购 下载PDF
基于并行模拟的多核集群系统性能预测和分析 认领 引用 被引量:6
10
作者 徐传福 车永刚 王正华 《国防科技大学学报》 EI CAS 北大核心 2010年第5期62-68,共7页
针对多核集群系统所表现出的新的性能特征,提出了面向多核集群系统消息传递应用程序的并行模拟模型并设计、实现了一个并行模拟器MCPSim(Multi-core Cluster Parallel Simulator),MCPSim在功能模型和性能模型上体现了片内核间、结点内... 针对多核集群系统所表现出的新的性能特征,提出了面向多核集群系统消息传递应用程序的并行模拟模型并设计、实现了一个并行模拟器MCPSim(Multi-core Cluster Parallel Simulator),MCPSim在功能模型和性能模型上体现了片内核间、结点内片间以及结点间等三个层次上消息通信的特点,同时支持对应用的消息数量、通信量等的百分比分布的profiling功能,采用PRIMEJ、acobi3D、NPB IS以及HPL等Benchmark程序对MCPSim进行了测试,结果表明MCPSim性能预测的精度优于BigSim,同时能够广泛应用于针对多核集群系统消息传递应用程序的性能分析中。 展开更多
关键词 多核集群 消息传递 并行模拟 性能预测
暂未订购 下载PDF
高性能的EBCOT编码及其VLSI结构 认领 引用 被引量:7
11
作者 刘凯 李云松 吴成柯 《软件学报》 EI 北大核心 2006年第7期1553-1560,共8页
提出了比特平面与编码过程全并行处理的EBCOT(embeddedblockcodingwithoptimizedtruncation)编码结构.通过分析JPEG2000和国内外提出的EBCOT编码结构,指出不仅每一个比特平面,而且对应的编码过程的编码信息可以同时获得,从而给出了比特... 提出了比特平面与编码过程全并行处理的EBCOT(embeddedblockcodingwithoptimizedtruncation)编码结构.通过分析JPEG2000和国内外提出的EBCOT编码结构,指出不仅每一个比特平面,而且对应的编码过程的编码信息可以同时获得,从而给出了比特平面与编码过程全并行处理的块编码方法,并且详细说明了实现的VLSI结构.理论分析以及具体实验结果表明,比特平面与编码过程全并行处理所需的时钟周期最少,FPGA原型系统最高时钟频率可达65MHz,对于512512的灰度图像,处理速度可达30fps,完全可以实时处理,图像质量达到了公布的JPEG2000标准. 展开更多
关键词 EBCOT算法 比特平面与编码过程全并行 块编码
暂未订购 下载PDF
基于并行运算体系结构的星敏感器图像处理算法 认领 引用 被引量:12
12
作者 毛晓楠 梁为升 郑循江 《宇航学报》 EI CAS CSCD 北大核心 2011年第3期613-619,共7页
采用FPGA构建星敏感器图像处理并行计算体系结构。星敏感器图像处理算法由高通滤波、星点提取和星点排序3个模块组成。高通滤波模块基于图像局部加窗计算阈值的方法,星点提取模块采用逐行扫描的计算方法,星点排序模块采用基数排序的计... 采用FPGA构建星敏感器图像处理并行计算体系结构。星敏感器图像处理算法由高通滤波、星点提取和星点排序3个模块组成。高通滤波模块基于图像局部加窗计算阈值的方法,星点提取模块采用逐行扫描的计算方法,星点排序模块采用基数排序的计算方法。星敏感器图像处理算法基于四级流水并行计算体系结构,显著提高了星敏感器图像处理的效率和算法的可靠性。 展开更多
关键词 星敏感器 图像处理 星点提取 高通滤波 并行计算 流水线 基数排序
暂未订购 下载PDF
JPEG2000全并行位平面编码器的VLSI设计验证 认领 引用 被引量:3
13
作者 刘文松 朱恩 +2 位作者 王健 徐龙涛 黄宁 《东南大学学报(自然科学版)》 EI CAS CSCD 北大核心 2011年第6期1132-1136,共5页
研究了JPEG2000位平面编码器的算法和全并行电路结构.以单列样本点作为数据单元,分析了通道编码过程中数据的关联性.只需缓存前一列样本点的显著性状态信息,并读取当前列和后续2列的原始数据,便可在一个编码窗口内完成当前列的通道和位... 研究了JPEG2000位平面编码器的算法和全并行电路结构.以单列样本点作为数据单元,分析了通道编码过程中数据的关联性.只需缓存前一列样本点的显著性状态信息,并读取当前列和后续2列的原始数据,便可在一个编码窗口内完成当前列的通道和位平面并行编码;每次仅需读入一列新的数据,即可实现编码循环.据此设计了三级流水线的全并行电路结构,仅需259个周期就可处理完32×32的小波子带,同时保持了较低的硬件开销.FPGA综合结果表明,系统时钟可以综合到76.355 MHz,达到301.9Mcoefficient/sec的处理能力,可满足现有图像实时处理要求. 展开更多
关键词 JPEG2000 位平面编码 通道并行 位平面并行 VLSI
暂未订购 下载PDF
面向并行图像处理的实时分布式操作系统的设计与实现 认领 引用 被引量:3
14
作者 石岩 毛海岑 +1 位作者 张天序 曹治国 《小型微型计算机系统》 北大核心 2005年第10期1821-1827,共7页
针对多片TMS320C64 DSP构成的多计算机体系结构的实时图像识别系统,设计并实现了面向并行图像处理的实时 分布式操作系统PIPORTDOS(Parallel image processing-oriented real-time distributed operating system).PIPORTDOS基于徽 内... 针对多片TMS320C64 DSP构成的多计算机体系结构的实时图像识别系统,设计并实现了面向并行图像处理的实时 分布式操作系统PIPORTDOS(Parallel image processing-oriented real-time distributed operating system).PIPORTDOS基于徽 内核体系结构,包括硬件抽象层、系统核心层、分布式消息通信机制和系统服务层四个层次.其多任务内核实现了基于优先级的 抢先式调度、任务间的同步和通信原语、实时的中断处理以及面向应用的缓存管理机制.为了实现对分布式并行图像处理的支 持.PIPORTDOS采用了基于消息传递(Message Passing)的方式,并在实现中充分考虑了上层图像处理算法的应用需求以及 DSP的硬件功能.相关性能指标表明,本文设计实现的PIPORTDOS完全可以满足系统的强实时性要求,在功能上也能适应算 法对不同并行结构的需求. 展开更多
关键词 实时图像处理 分布式操作系统 消息传递 并行系统 TMS320C64
暂未订购 下载PDF
消息传递并行程序的弱变异测试及其转化 认领 引用 被引量:2
15
作者 巩敦卫 陈永伟 田甜 《软件学报》 EI CSCD 北大核心 2016年第8期2008-2024,共17页
并行程序执行的不确定性,增加了测试的复杂性和难度.研究消息传递并行程序的变异测试,提出其弱变异测试转化方法,以提高该程序变异测试的效率.首先,根据消息传递并行程序包含语句的类型和语句变异之后导致的变化构建相应的变异条件语句... 并行程序执行的不确定性,增加了测试的复杂性和难度.研究消息传递并行程序的变异测试,提出其弱变异测试转化方法,以提高该程序变异测试的效率.首先,根据消息传递并行程序包含语句的类型和语句变异之后导致的变化构建相应的变异条件语句;然后,将构建好的所有变异条件语句插入到原程序中,形成新的被测程序,从而将原程序的弱变异测试问题转化为新程序的分支覆盖问题.这样做的好处是,能够利用已有的分支覆盖方法解决变异测试问题.将该方法应用于8个典型的消息传递并行程序测试中,实验结果表明,该方法不但是可行的,也是必要的. 展开更多
关键词 消息传递 并行程序 变异测试 弱变异测试 转化 变异条件语句
暂未订购 下载PDF
基于非参数方法的频率密度分布计算及其并行优化 认领 引用 被引量:2
16
作者 宋磊 尹俊平 沈卫超 《强激光与粒子束》 EI CAS CSCD 北大核心 2014年第7期239-242,共4页
跳频序列预测是信息对抗的关键问题之一。基于跳频序列具有的伪随机特性和数据之间连续分布的相似性,采用非参数密度估计方法计算并预测出频率的大概率分布区间,进而用于引导通信的梳状灵巧干扰。针对实际应用对实时性的要求,在多结点... 跳频序列预测是信息对抗的关键问题之一。基于跳频序列具有的伪随机特性和数据之间连续分布的相似性,采用非参数密度估计方法计算并预测出频率的大概率分布区间,进而用于引导通信的梳状灵巧干扰。针对实际应用对实时性的要求,在多结点多核平台上实现了基于消息传递机制的可扩展计算。测试表明,并行程序计算结果正确,并且具有较好的可扩展性。 展开更多
关键词 复杂电磁环境 跳频序列预测 非参数密度估计 R 消息传递 并行优化
暂未订购 下载PDF
消息传递型片上多核系统的设计 认领 引用 被引量:2
17
作者 胡哲琨 陈杰 《湖南大学学报(自然科学版)》 EI CAS CSCD 北大核心 2013年第8期102-109,共8页
基于消息传递的编程模型设计了一款片上多核系统,该系统在4$4的2Dmesh片上网络中集成了16个小型RISC处理器,这些处理器各自使用一个可配置的私有SRAM用于指令和数据的存储,而处理器间的数据包通信则通过虫孔交换的路由器及网络接口实现... 基于消息传递的编程模型设计了一款片上多核系统,该系统在4$4的2Dmesh片上网络中集成了16个小型RISC处理器,这些处理器各自使用一个可配置的私有SRAM用于指令和数据的存储,而处理器间的数据包通信则通过虫孔交换的路由器及网络接口实现.此外,在软件层面实现了基本的数据传输与进程同步接口,并采用SPMD并行模式设计了3个应用案例,以对该系统进行验证和性能分析.仿真及FPGA测试结果表明,对于整数矩阵乘法、浮点FFT计算以及基于灰度图像的模板匹配问题,该多核系统的并行加速比最高可分别达到7.6,10.5和15.9. 展开更多
关键词 多核系统 片上网络 消息传递 并行计算
暂未订购 下载PDF
格子Boltzmann方法三维并行程序设计 认领 引用 被引量:1
18
作者 梁功有 曾忠 +1 位作者 张良奇 谢海琼 《水动力学研究与进展(A辑)》 CSCD 北大核心 2011年第5期531-537,共7页
采用单松弛不可压缩D3Q19格子Boltzmann模型,自主开发了基于性能优化和MPI并行的程序包。程序通过合并碰撞迁移过程和引入临时数组以连续读入分布函数的优化处理,使程序计算性能得以大幅提高。并行程序在遵循负载均衡原则下采用单向区... 采用单松弛不可压缩D3Q19格子Boltzmann模型,自主开发了基于性能优化和MPI并行的程序包。程序通过合并碰撞迁移过程和引入临时数组以连续读入分布函数的优化处理,使程序计算性能得以大幅提高。并行程序在遵循负载均衡原则下采用单向区域分解,使用非阻塞通信模式进行数据交换,同时采用并行I/O以便各个进程同步进行I/O操作。通过对三维顶盖驱动流的数值模拟,验证了该程序的正确性及其并行效率。 展开更多
关键词 格子Boltzmann方法 MPI并行 消息传递 并行I/O 顶盖驱动流
暂未订购 下载PDF
SCMA系统中改进的MAX-Log MPA多用户检测算法 认领 引用 被引量:7
19
作者 张雪婉 葛文萍 +1 位作者 吴雄 代文丽 《计算机工程》 CAS CSCD 北大核心 2018年第10期124-128,共5页
在稀疏码多址接入(SCMA)系统的多用户检测过程中,MAX-Log消息传递算法(MPA)由于采用了近似计算造成部分消息丢失,检测性能较差。为此,通过理论推导得出更接近真实值的约近方法,提出一种改进的MAX-Log MPA算法。对资源节点消息更新公式... 在稀疏码多址接入(SCMA)系统的多用户检测过程中,MAX-Log消息传递算法(MPA)由于采用了近似计算造成部分消息丢失,检测性能较差。为此,通过理论推导得出更接近真实值的约近方法,提出一种改进的MAX-Log MPA算法。对资源节点消息更新公式乘以一个值为2的常数,从而减少原始MAX-Log MPA因近似计算造成的消息丢失,提升MAX-Log MPA多用户检测器的检测性能。理论与仿真结果表明,改进算法能够在保持原算法低复杂度优点的同时,有效提升检测性能。 展开更多
关键词 稀疏码多址接入 多用户检测 消息传递算法 并行 串行
暂未订购 下载PDF
公平消息传递并行程序设计的Petri网方法 认领 引用 被引量:1
20
作者 崔焕庆 吴哲辉 方欢 《系统仿真学报》 CAS 北大核心 2009年第13期3933-3936,3940,共4页
公平性是并行程序正确的主要标准之一,但是并行程序执行的不确定性导致公平性验证较为困难。针对消息传递模式的并行程序,在建立相应Petri网模型的基础上,首先证明了并行程序的公平性与其Petri网模型的公平性之间的关系,然后提出了利用T... 公平性是并行程序正确的主要标准之一,但是并行程序执行的不确定性导致公平性验证较为困难。针对消息传递模式的并行程序,在建立相应Petri网模型的基础上,首先证明了并行程序的公平性与其Petri网模型的公平性之间的关系,然后提出了利用T-不变量判断并行程序公平性,以及通过添加控制库所实现并行程序公平的算法,最后指出了将改造后的模型转换为公平并行程序的方法,并用一个实例进行了验证。 展开更多
关键词 消息传递并行程序 公平性 Petri网 T-不变量 控制库所
暂未订购 下载PDF
上一页 1 2 11 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈