期刊文献+
共找到114篇文章
< 1 2 6 >
每页显示 20 50 100
AN OBJECT ORIENTED C++ PARALLEL COMPILER SYSTEM 认领 引用
1
作者 XiaoNong Shouren HU 《Wuhan University Journal of Natural Sciences》 CAS 1996年第Z1期437-441,共5页
An object-oriented C++ parallel compiler System, called OOCPCS, is developed to facilitate programmers to write sequential programs using C++ or Annotated C++ language for parallel computahon. OOCPCS bases on an integ... An object-oriented C++ parallel compiler System, called OOCPCS, is developed to facilitate programmers to write sequential programs using C++ or Annotated C++ language for parallel computahon. OOCPCS bases on an integrated object-oriented paradigm and large-grain data flow model, called OOLGDFM, and recognizes automatically parallel objects using parallel compiling techniques. The paper describes the object-oriented parallel model and realization of the System on networks. 展开更多
关键词 object-oriented parallel System compiler
暂未订购 下载PDF
A High Speed Signal Processing Machine -Its Architecture, Language and Compiler 认领 引用
2
作者 Wang Yufei and Yu ShiqiBeijing Institute of Data Processing Technology, P.O.Box 3927, Beijing 100039, China 《Journal of Systems Engineering and Electronics》 1991年第1期119-128,共10页
A systolic array architecture computer (FXCQ) has been designed for signal processing. R can handle floating point data at very high speed. It is composed of 16 processing cells and a cache that are connected linearly... A systolic array architecture computer (FXCQ) has been designed for signal processing. R can handle floating point data at very high speed. It is composed of 16 processing cells and a cache that are connected linearly and form a ring structure. All processing cells are identical and programmable. Each processing cell has the peak performance of 20 million floating-point operations per second (20MFLOPS). The machine therefore has a peak performance of 320 M FLOPS. It is integrated as an attached processor into a host system through VME bus interface. Programs for FXCQ are written in a high-level language -B language, which is supported by a parallel optimizing compiler. This paper describes the architecture of FXCQ, B language and its compiler. 展开更多
关键词 Parallel processing Systolic array processor Parallel language Compiler.
暂未订购 下载PDF
Object-oriented software tools for parallel PDE solvers 认领 引用
3
作者 Michael Thune 《Wuhan University Journal of Natural Sciences》 CAS 1996年第Z1期420-429,共10页
An object-oriented approach is taken to the problem of formulating portable, easy-to-modify PDE solvers for realistic problems in three space dimensions. The resulting software library, Cogito, contains tools for writ... An object-oriented approach is taken to the problem of formulating portable, easy-to-modify PDE solvers for realistic problems in three space dimensions. The resulting software library, Cogito, contains tools for writing programs to be executed on MIMD computers with distributed memory. Difference methods on composite, structured grids are supported. Most of the Cogito classes have been implemented in Fortran 77, in such a way that the object-oriented design is visible. With respect to parallel performance, these tools yield code that is comparable to parallel solvers written in plain Fortran 77. The resulting programs are can be executed without modification on a large number of multicomputer platforms, and also on serial computers. The uppermost level of abstraction in Cogito concerns the problem of decoupling the numerical method from the PDE problem. The validity of these tools has been preliminarily demonstrated with a C++ implementation for one-dimensional problems. 展开更多
关键词 object-oriented software tool parallel computer PDE,composite grid difference method
暂未订购 下载PDF
IOPS:computational graph optimization based on inter-operators parallel scheduling 认领 引用
4
作者 谢晓燕 XU Hao +1 位作者 ZHU Yun HE Wanqi 《High Technology Letters》 EI CAS 2023年第1期50-59,共10页
To improve the inference efficiency of convolutional neural networks(CNN),the existing neural networks mainly adopt heuristic and dynamic programming algorithms to realize parallel scheduling among operators.Heuristic... To improve the inference efficiency of convolutional neural networks(CNN),the existing neural networks mainly adopt heuristic and dynamic programming algorithms to realize parallel scheduling among operators.Heuristic scheduling algorithms can generate local optima easily,while the dynamic programming algorithm has a long convergence time for complex structural models.This paper mainly studies the parallel scheduling between operators and proposes an inter-operator parallelism schedule(IOPS)scheduling algorithm that guarantees the minimum similar execution delay.Firstly,a graph partitioning algorithm based on the largest block is designed to split the neural network model into multiple subgraphs.Then,the operators that meet the conditions is replaced according to the defined operator replacement rules.Finally,the optimal scheduling method based on backtracking is used to schedule the computational graph.Network models such as Inception-v3,ResNet-50,and RandWire are selected for testing.The experimental results show that the algorithm designed in this paper can achieve a 1.6×speedup compared with the existing sequential execution methods. 展开更多
关键词 compile optimization convolutional neural network(CNN) inter-operator parallelism schedule(IOPS) operator replacement
暂未订购 下载PDF
Register Allocation Compilation Technique for ASIP in 5G Micro Base Stations 认领 引用
5
作者 Wei Chen Dake Liu Shaohan Liu 《China Communications》 SCIE CSCD 2022年第8期115-126,共12页
The currently available compilation techniques are for general computing and are not optimized for physical layer computing in 5G micro base stations.In such cases,the foreseeable data sizes and small code size are ap... The currently available compilation techniques are for general computing and are not optimized for physical layer computing in 5G micro base stations.In such cases,the foreseeable data sizes and small code size are application specific opportunities for baseband algorithm optimizations.Therefore,the special attention can be paid,for example,the specific register allocation algorithm has not been studied so far.The compilation for kernel sub-routines of baseband in 5G micro base stations is our focusing point.For applications of known and fixed data size,we proposed a compilation scheme of parallel data accessing,while operands can be mainly allocated and stored in registers.Based on a small register group(48×32b),the target of our compilation scheme is the optimization of baseband algorithms based on 4×4 or smaller matrices,maximizing the utilization of register files,and eliminating the extra register data exchanging.Meanwhile,when data is allocated into register files,we used VLIW(Very Long Instruction Word)machine to hide the time of data accessing and minimize the cost of data accessing,thus the total execution time is minimum.Experiments indicate that for algorithms with small data size,the cost of data accessing and extra addressing can be minimized. 展开更多
关键词 parallel data access compilation small size matrix 5G micro base stations register allocation algorithm
暂未订购 下载PDF
CCOC:An Optimizing Compiling System for Concurrent C Supporting Inter-process Code Analysis and Optimization 认领 引用
6
作者 孟丹 郭福顺 《Journal of Harbin Institute of Technology(New Series)》 CAS 1995年第3期29-35,共7页
At present, there are some static code analyses and optimizations that can be applied to Concurrent C programs to improve their performance or verify their logical correctness. These analyses and optimizations are int... At present, there are some static code analyses and optimizations that can be applied to Concurrent C programs to improve their performance or verify their logical correctness. These analyses and optimizations are inter-process. In order to make their implementation easy, we propose a new method to construct an optimizing compiling system CCOC for Concurrent C. CCOC supports inter-process code analysis and optimization to Concurrent C programs and does not affect the system's portability and separate compilation of source programs. We also discuss some implementation details of CCOC briefly. 展开更多
关键词 ss: Optimizing compiling system portable compilirg system inter-process code analysis and optimization Concurrent C parallel processing
暂未订购 下载PDF
Shared Variable Oriented Parallel Precompiler for SPMD Model 认领 引用
7
作者 康继昌 朱怡安 +1 位作者 洪远麟 应必善 《Journal of Computer Science & Technology》 SCIE EI 1995年第5期476-480,共5页
For the moment, commercial parallel computer systems with distributed memory architecture are usually provided with parallel FORTRAN or parallel C compliers, which are just traditional sequential FORTRAN or C compiler... For the moment, commercial parallel computer systems with distributed memory architecture are usually provided with parallel FORTRAN or parallel C compliers, which are just traditional sequential FORTRAN or C compilers expanded with communication statements. Programmers suffer from writing parallel programs with communication statements.The Shared Variable Oriented Parallel Precompiler (SVOPP) proposed in this paper can automatically generate appropriate communication statements based on shared variables for SPMD (Single Program Multiple Data) computa-tion model and greatly ease the parallel programming with high communication efficiency. The core function of parallel C precompi1er has been successfully veri-fied on a transputer-based parallel computer. Its prominent performance shows that SVOPP is probably a break-through in parallel programming technique. 展开更多
关键词 Parallel computer parallel compiler parallel precompiler communication statement
暂未订购 下载PDF
论民国骈文选本中的六朝骈文理论——以《南北朝文评注读本》与《南北朝文举要》为中心 认领 引用
8
作者 刘涛 《韩山师范学院学报》 2025年第4期31-37,共7页
六朝骈文理论在民国时期仍备受推重,诸多骈文选本对其都有较详细的阐发。选家主要通过凡例和序跋表达出对编纂缘起、选文标准、选录范围、骈文起源、骈散关系、六朝骈文的骈体正宗地位、徐庾骈文特点、汉魏六朝骈文的演进历程等问题的看... 六朝骈文理论在民国时期仍备受推重,诸多骈文选本对其都有较详细的阐发。选家主要通过凡例和序跋表达出对编纂缘起、选文标准、选录范围、骈文起源、骈散关系、六朝骈文的骈体正宗地位、徐庾骈文特点、汉魏六朝骈文的演进历程等问题的看法;又通过语词训释、征引前人之说和自撰评语对六朝骈文的藻饰、炼字、用典等予以分析讨论。其中,既有对前人观点的继承,又有明显的突破,体现出选家与评点者对六朝骈文文体多方位深层次的观照和体认,于后学研读鉴赏六朝骈文多有裨益。 展开更多
关键词 民国骈文选本 编选宗旨 六朝骈文 理论内涵
暂未订购 下载PDF
开源CFD软件SU2在Linux集群的并行计算性能编译优化研究 认领 引用
9
作者 杨富军 《软件导刊》 2025年第9期106-111,共6页
近年来斯坦福大学开发的开源CFD软件SU2,在高性能计算领域得到越来越多的关注和应用。因此,探究如何提高该软件的并行计算效率变得尤为重要。基于“魔方3”高性能计算集群,通过实际案例测试,研究了编译时所使用的编译器、MPI类型和版本... 近年来斯坦福大学开发的开源CFD软件SU2,在高性能计算领域得到越来越多的关注和应用。因此,探究如何提高该软件的并行计算效率变得尤为重要。基于“魔方3”高性能计算集群,通过实际案例测试,研究了编译时所使用的编译器、MPI类型和版本、编译优化参数,以及MPI+OpenMP混合并行模式对SU2求解器计算性能的影响。结果表明,ICC/ICPC编译器和Intel MPI表现更优异;O3级别优化、指定CPU架构、使用MKL库以及混合精度选项组合能够显著提高并行计算效率;对于多节点并行,设定合适的OpenMP线程数采用混合并行模式,相比单纯的MPI并行能够进一步提高计算效率。 展开更多
关键词 SU2软件 Linux集群 并行计算 编译优化
暂未订购 下载PDF
融合循环展开的向量VLIW体系结构软件流水研究 认领 引用
10
作者 汤卓悠 胡勇华 +1 位作者 程奥博 刘澎 《软件导刊》 2025年第6期95-101,共7页
基于超长指令字(VLIW)体系结构的处理器具有丰富的寄存器与计算资源,充分利用这些资源可以极大地提升程序运行速度。软件流水是位于编译器后端的一项优化技术,可以提高硬件资源利用率。目前的软件流水算法对原循环次数的考虑往往不够周... 基于超长指令字(VLIW)体系结构的处理器具有丰富的寄存器与计算资源,充分利用这些资源可以极大地提升程序运行速度。软件流水是位于编译器后端的一项优化技术,可以提高硬件资源利用率。目前的软件流水算法对原循环次数的考虑往往不够周全,得到的新循环体对寄存器资源的利用率有待提高。因此,提出一种融合循环展开的软件流水优化方法。该方法首先将循环展开,然后进行软件流水处理。一方面改进软件流水序言、主体与尾声排列方式,另一方面分析在不同启动间距下经过软件流水优化后循环主体内执行包的数量,确定最佳的软件流水启动间距。使用该方法优化后的循环体具有更高的指令调度自由度,有利于得到运行速度更快的目标代码。经过实验验证,该方法优化后的代码与仅进行循环展开优化的代码相比,平均速度提升了5%。 展开更多
关键词 VLIW体系结构 高性能处理器 编译优化 软件流水 指令级并行优化
暂未订购 下载PDF
方志编纂制度化视角下清代三部《武宁县志》编纂体例与内容的衍变及成因 认领 引用
11
作者 方宁 《南昌师范学院学报》 2025年第5期22-29,共8页
清代,方志编修进入全盛期,地处赣西北的武宁县在这一时期持续编纂的志书有七部之多。自明代起,方志编修逐渐形成制度化,即朝廷颁布命令,省修通志颁定程式,府州县按程式编修各级志书,且以官方主导、民间参与的模式推动修志。乾嘉以后,考... 清代,方志编修进入全盛期,地处赣西北的武宁县在这一时期持续编纂的志书有七部之多。自明代起,方志编修逐渐形成制度化,即朝廷颁布命令,省修通志颁定程式,府州县按程式编修各级志书,且以官方主导、民间参与的模式推动修志。乾嘉以后,考据学盛行,其治学原则和方法渗透到方志编纂中。通过对清代不同时期编纂的三部《武宁县志》体例、内容和资料征引等方面的考察,可以发现,在方志编纂制度化、地方“崇儒复古”文风和乾嘉考据学流行的影响下,志书编纂经过不断发展衍变,呈现出编纂体例渐趋程式化和固定化、编纂内容渐趋考据化、资料征引渐趋多样化等特征。虽然这三部志书时代特征鲜明,但地域特色却略显不足。 展开更多
关键词 武宁县志 编纂体例 分纲列目 细目并列 考据化
暂未订购 下载PDF
SIMD自动向量化编译优化概述 认领 引用 被引量:38
12
作者 高伟 赵荣彩 +2 位作者 韩林 庞建民 丁锐 《软件学报》 EI CSCD 北大核心 2015年第6期1265-1284,共20页
SIMD扩展部件是集成到通用处理器中的加速部件,旨在发掘多媒体程序和科学计算程序的数据级并行.首先介绍SIMD扩展部件的背景和研究现状,然后从发掘方法、数据布局、多平台向量化这3个角度介绍了SIMD自动向量化的研究问题、困难和最新研... SIMD扩展部件是集成到通用处理器中的加速部件,旨在发掘多媒体程序和科学计算程序的数据级并行.首先介绍SIMD扩展部件的背景和研究现状,然后从发掘方法、数据布局、多平台向量化这3个角度介绍了SIMD自动向量化的研究问题、困难和最新研究成果,最后展望了SIMD编译优化未来的研究方向. 展开更多
关键词 SIMD扩展部件 自动向量化 数据级并行 编译优化
暂未订购 下载PDF
低功耗多线程编译优化技术 认领 引用 被引量:16
13
作者 赵荣彩 唐志敏 +1 位作者 张兆庆 GuangR.Gao 《软件学报》 EI 北大核心 2002年第6期1123-1129,共7页
提出了在多线程体系结构中通过降低执行频率有效减小功耗的理论模型和方法.首先研究识别可降频运行的线程的计算模型和降频因子的计算,然后给出在编译过程中基于对应用程序行为的分析,结合线程划分的低功耗编译优化算法和实现策略.该模... 提出了在多线程体系结构中通过降低执行频率有效减小功耗的理论模型和方法.首先研究识别可降频运行的线程的计算模型和降频因子的计算,然后给出在编译过程中基于对应用程序行为的分析,结合线程划分的低功耗编译优化算法和实现策略.该模型和方法可用于具有执行频率可动态调整的多处理器类多线程体系结构,既可开发TLP(thread level parallelism),又可有效减小功率消耗. 展开更多
关键词 多线程 低功耗 编译优化 并行处理 计算机系统
暂未订购 下载PDF
面向全分布式智能建筑系统应用程序的并行化编译方法 认领 引用 被引量:3
14
作者 陈文杰 杨启亮 +4 位作者 姜子炎 邢建春 周启臻 邹荣伟 冯博伟 《软件学报》 EI CSCD 北大核心 2024年第6期2724-2752,共29页
群体智能系统通过邻居个体的信息交互实现群体级别的应用任务,具有良好的鲁棒性和灵活性.与此同时,大多数开发人员难以对分布式、并行的个体交互机制进行描述.一些高级语言允许用户以串行思维方式、从系统全局角度来编程并行的群体智能... 群体智能系统通过邻居个体的信息交互实现群体级别的应用任务,具有良好的鲁棒性和灵活性.与此同时,大多数开发人员难以对分布式、并行的个体交互机制进行描述.一些高级语言允许用户以串行思维方式、从系统全局角度来编程并行的群体智能计算任务,而无需考虑通信协议、数据分布等底层交互细节.但面向用户、全局声明式的群体智能系统应用程序与个体并行执行逻辑存在的巨大语义差距,使得编译过程复杂进而导致应用程序开发效率不高.提出一个编译系统及其支撑工具,支持将高级的群体智能系统应用程序转换为安全、高效的分布式实现.所提编译系统通过并行信息识别,计算划分,交互信息生成技术,将面向系统全局、串行编程的群体智能应用程序编译为面向个体独立执行的并行目标代码,从而使用户不必了解个体间的复杂交互机制.设计一种标准化中间表示,将复杂群体智能计算任务转换为群体智能算子和输入输出变量组合而成的标准化语义模块序列,其以独立于平台的形式表示源程序信息,屏蔽目标硬件平台的异构性.在一个群体智能系统案例平台中部署和测试所提编译系统,结果表明该系统能够有效将群体智能应用程序编译为平台可执行的目标代码并提升应用程序开发效率,其生成的代码在一系列基准测试中具有比现有编译器更好的性能. 展开更多
关键词 群体智能 应用程序 编译系统 并行化编译
暂未订购 下载PDF
异构并行编程模型研究与进展 认领 引用 被引量:13
15
作者 刘颖 吕方 +3 位作者 王蕾 陈莉 崔慧敏 冯晓兵 《软件学报》 EI CSCD 北大核心 2014年第7期1459-1475,共17页
近年来,异构系统硬件飞速发展.为了解决相应的编程和执行效率问题,异构并行编程模型已被广泛使用和研究.从异构并行编程接口与编译/运行时支持系统两个角度总结了异构并行编程模型最新的研究成果,它们为异构架构和上层应用带来的技术挑... 近年来,异构系统硬件飞速发展.为了解决相应的编程和执行效率问题,异构并行编程模型已被广泛使用和研究.从异构并行编程接口与编译/运行时支持系统两个角度总结了异构并行编程模型最新的研究成果,它们为异构架构和上层应用带来的技术挑战提供了相应的解决方案.最后,结合目前的研究现状以及异构系统的发展,提出了异构并行编程模型的未来方向. 展开更多
关键词 异构并行编程模型 异构系统 GPU 编程接口 编译 运行时系统
暂未订购 下载PDF
基于嵌套循环分类的并行识别技术 认领 引用 被引量:5
16
作者 赵捷 赵荣彩 +1 位作者 丁锐 黄品丰 《软件学报》 EI CSCD 北大核心 2012年第10期2695-2704,共10页
传统的分布存储并行编译系统大多是在共享存储并行编译系统的基础上开发的.共享存储并行编译系统的并行识别技术适合OpenMP代码生成,实现方式是将所有嵌套循环都按照相同的识别方法进行处理,用于分布存储并行编译系统必然会导致无法高... 传统的分布存储并行编译系统大多是在共享存储并行编译系统的基础上开发的.共享存储并行编译系统的并行识别技术适合OpenMP代码生成,实现方式是将所有嵌套循环都按照相同的识别方法进行处理,用于分布存储并行编译系统必然会导致无法高效发掘程序的并行性.分布存储并行编译系统应根据嵌套循环结构的特点进行分类处理,提出适合MPI代码生成的并行识别技术.为解决上述问题,根据嵌套循环的结构和MPI并行程序的特点,提出了一种新的嵌套循环分类方法,并针对不同的嵌套循环分别提出了相应的并行识别技术.实验结果表明,与采用传统并行识别技术的分布存储并行编译系统相比,按照所提方法对嵌套循环进行分类,采用相应并行识别技术的编译系统能够更高效地识别基准程序中的并行循环,自动生成的MPI并行代码其性能加速比提高了20%以上. 展开更多
关键词 并行编译 并行识别 嵌套循环 模型法 遍历法 交互法
暂未订购 下载PDF
一种面向异构众核处理器的并行编译框架 认领 引用 被引量:9
17
作者 李雁冰 赵荣彩 +3 位作者 韩林 赵捷 徐金龙 李颖颖 《软件学报》 EI CSCD 北大核心 2019年第4期981-1001,共21页
异构众核处理器是面向高性能计算领域处理器发展的重要趋势,但其更为复杂的体系结构使得编程难的问题更加突出.针对这一问题,基于开源编译器Open64,提出了一种面向异构众核处理器的并行编译框架,将程序自动转换为异构并行程序.该框架主... 异构众核处理器是面向高性能计算领域处理器发展的重要趋势,但其更为复杂的体系结构使得编程难的问题更加突出.针对这一问题,基于开源编译器Open64,提出了一种面向异构众核处理器的并行编译框架,将程序自动转换为异构并行程序.该框架主要包括4个模块:任务划分模块用来识别适合进行加速计算的程序段,实现了嵌套循环的多维并行识别方法;数据布局模块完成数据在主存和SPM之间的布局,实现了数组边界分析和指针范围分析;传输优化模块实现了数据传输合并、传输外提、打包传输、数组转置等多种数据传输优化方法;收益评估模块在构建代价模型的基础上实现了一种动静结合的收益评估方法.并且,基于SW26010处理器,对该编译框架进行了实现,测试结果表明,该编译框架能够实现一些程序以面向异构众核结构的并行变换,且获得较好的加速效果. 展开更多
关键词 异构众核处理器 SW26010 并行编译 数据传输优化 OpenACC
暂未订购 下载PDF
基于位宽控制提高SIMD架构并行度的优化算法 认领 引用 被引量:5
18
作者 张为华 朱嘉华 +1 位作者 张宏江 臧斌宇 《计算机学报》 EI CAS 北大核心 2009年第11期2168-2177,共10页
随着SIMD功能单元作为多媒体加速部件的广泛应用,如何有效利用这一构架优化应用程序成为编译优化研究的热点.目前典型的SIMD结构为同一操作对不同的数据位宽提供了不同的指令版本,随着操作数位宽的增加,对应的SIMD指令可同时完成的操作... 随着SIMD功能单元作为多媒体加速部件的广泛应用,如何有效利用这一构架优化应用程序成为编译优化研究的热点.目前典型的SIMD结构为同一操作对不同的数据位宽提供了不同的指令版本,随着操作数位宽的增加,对应的SIMD指令可同时完成的操作个数也随之降低.因此,如何有效识别操作数的有效位宽,对提高优化过程中SIMD指令内操作的并行度将产生至关重要的影响.文中针对SIMD优化面临的并行度问题,提出了一种优化算法,该算法在对操作数的有效位进行分析的基础上,进行溢出控制,从而减少操作数对宽位宽数据类型的依赖.实验数据表明,该算法可以有效提高多媒体程序优化的并行度,对多媒体程序获得较好的加速效果. 展开更多
关键词 有效位控制 溢出处理 饱和算术 编译优化 并行度
暂未订购 下载PDF
自动向量化:近期进展与展望 认领 引用 被引量:10
19
作者 冯竞舸 贺也平 陶秋铭 《通信学报》 EI CSCD 北大核心 2022年第3期180-195,共16页
随着单指令流多数据流(SIMD)技术的迅速发展,近年来许多面向SIMD扩展部件的自动向量化编译方法被提出,有效缓解了程序员手写向量程序的压力,并发挥了SIMD扩展部件的加速效能。基于此,分析总结了自动向量化领域近10年的研究成果,从保义... 随着单指令流多数据流(SIMD)技术的迅速发展,近年来许多面向SIMD扩展部件的自动向量化编译方法被提出,有效缓解了程序员手写向量程序的压力,并发挥了SIMD扩展部件的加速效能。基于此,分析总结了自动向量化领域近10年的研究成果,从保义分析和变换、向量化分组分析和变换、面向处理器支持特性的分析和变换以及性能评估分析这4个方面分类归纳了自动向量化的关键问题和主要突破,进而对4个方面的发展趋势和研究方向进行了展望。 展开更多
关键词 自动向量化 SIMD扩展 编译技术 数据级并行 性能优化
暂未订购 下载PDF
一种针对结构化并行控制机制的任务调度算法 认领 引用 被引量:4
20
作者 张宏莉 方滨兴 胡铭曾 《软件学报》 EI 北大核心 2001年第5期706-710,共5页
缩短程序的执行时间是并行处理的首要目标 ,有效的任务分配算法是实现这一目标的关键 ,对机群系统来说更是如此 .研究机群系统上针对结构化并行控制机制的任务调度问题 ,并基于贪心算法、粒度控制、反馈式分派的原则 ,提出近优的任务调... 缩短程序的执行时间是并行处理的首要目标 ,有效的任务分配算法是实现这一目标的关键 ,对机群系统来说更是如此 .研究机群系统上针对结构化并行控制机制的任务调度问题 ,并基于贪心算法、粒度控制、反馈式分派的原则 ,提出近优的任务调度算法 SSA(sub- optimal scheduling algorithm) .实验结果表明 ,在机群环境下 ,该算法的并行计算性能与其他算法相比均有所提高 . 展开更多
关键词 任务调度算法 结构化并行控制 机群系统 并行处理
暂未订购 下载PDF
上一页 1 2 6 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈