期刊文献+
共找到35篇文章
< 1 2 >
每页显示 20 50 100
针对流多处理器访存资源的动态重分配架构 认领 引用
1
作者 宋鹏皓 王剑 《高技术通讯》 CAS 北大核心 2026年第5期467-477,共11页
通用图形处理器作为并行处理领域最重要的硬件范式,其执行性能不仅依赖于计算资源的数量,更与访存效率息息相关。作为通用图形处理器的核心模块,流多处理器在最新设计中均采用了同构子核的分离式结构,这虽然有效降低了功耗和面积的开销... 通用图形处理器作为并行处理领域最重要的硬件范式,其执行性能不仅依赖于计算资源的数量,更与访存效率息息相关。作为通用图形处理器的核心模块,流多处理器在最新设计中均采用了同构子核的分离式结构,这虽然有效降低了功耗和面积的开销,但同时也带来了新的访存调度需求。本文测试了不同子核的访存阻塞比例,同时研究了访存延迟在一级数据缓存中的主要成因。分析结果显示子核同时阻塞现象具有显著的普遍性,此时所有计算资源陷入停滞而被浪费;实验确定了引发请求阻塞的2大核心因素——地址组冲突和缺失队列资源竞争。为了缓解访存阻塞并提高资源利用率,本文提出了针对访存资源的动态重分配架构,该架构包含了重分配状态转换框架与失败队列。前者为所有子核赋予了不同的访存优先级,以减少子核同步前进导致的访存竞争;后者通过在关键位置增加有限资源,有效缓解了缓存中并发请求的竞争压力,从而减少访存阻塞引发的延迟。最终的实验结果显示,相比于基准结构,本文提出的动态重分配架构最高能达到22.03%的性能提升,在测试集上的平均性能提升则有6.28%,同时该架构还能降低3.51%的能量消耗。 展开更多
关键词 通用图形处理器 流多处理器 访存调度 动态资源分配 线程级并行
暂未订购 下载PDF
Simultaneous Multithreading Fault Tolerance Processor 认领 引用
2
作者 DONGLan HUMing-zeng +3 位作者 JIZhen-zhou CUIGuang-zuo TANGXin-min HEFeng 《Wuhan University Journal of Natural Sciences》 EI CAS 2005年第1期17-20,共4页
Transient fault detection mechanism is added to simultaneous multithreading architecture. By exploiting both ILP (Instruction Level Parallelism) and TLP (Thread Level Parallelism), Simultaneous Multithreading (SMT) Fa... Transient fault detection mechanism is added to simultaneous multithreading architecture. By exploiting both ILP (Instruction Level Parallelism) and TLP (Thread Level Parallelism), Simultaneous Multithreading (SMT) Fault Tolerance Processor can be expected to achieve better tradeoff between performance and hardware cost than traditional Fault Tolerance Processors. Detailed simulations of 3 of SPEC95 benchmarks show that executing two redundant programs on the fault-tolerant microarchitecture takes only 40%–61%longer than running a single version of the program. The new instruction fetch algorithm enhances the performance by 0.4%~1%to most of the benchmarks we choose randomly. 展开更多
关键词 Key words simultaneous multithreading rault tolerance TLP (Thread Level Parallelism) fetch policy
暂未订购 下载PDF
一种异构多核系统动态调度协处理器设计 认领 引用 被引量:1
3
作者 曾树铭 倪伟 《合肥工业大学学报(自然科学版)》 CAS 北大核心 2025年第2期185-195,共11页
为研究异构多核片上系统(multi-processor system on chip,MPSoC)在密集并行计算任务中的潜力,文章设计并实现了一种适用于粗粒度数据特征、面向任务级并行应用的异构多核系统动态调度协处理器,采用了片上缓存、任务输出的多级写回管理... 为研究异构多核片上系统(multi-processor system on chip,MPSoC)在密集并行计算任务中的潜力,文章设计并实现了一种适用于粗粒度数据特征、面向任务级并行应用的异构多核系统动态调度协处理器,采用了片上缓存、任务输出的多级写回管理、任务自动映射、通讯任务乱序执行等机制。实验结果表明,该动态调度协处理器不仅能够实现任务级乱序执行等基本设计目标,还具有极低的调度开销,相较于基于动态记分牌算法的调度器,运行多个子孔径距离压缩算法的时间降低达17.13%。研究结果证明文章设计的动态调度协处理器能够有效优化目标场景下的任务调度效果。 展开更多
关键词 动态调度 硬件调度器 异构多核系统 任务级并行 编程模型 片上缓存 片上网络
暂未订购 下载PDF
Optimization Strategies Oriented to Loop Characteristics in Software Thread Level Speculation Systems 认领 引用 被引量:3
4
作者 Li Shen Fan Xu Zhi-Ying Wang 《Journal of Computer Science & Technology》 SCIE EI CSCD 2016年第1期60-76,共17页
Thread level speculation provides not only a simple parallel programming model,but also an effective mech-anism for thread-level parallelism exploitation.The performance of software speculative parallel models is limi... Thread level speculation provides not only a simple parallel programming model,but also an effective mech-anism for thread-level parallelism exploitation.The performance of software speculative parallel models is limited by high global overheads caused by different types of loops.These loops usually have different characteristics of dependencies and different requirements of optimization strategies.In this paper,we propose three comprehensive optimization techniques to reduce different factors of global overheads,aiming at requirements from different types of loops.Inter-thread fetching can reduce the high mis-speculation rate of the loops with frequent dependencies and out-of-order committing can reduce the control overhead of the loops with infrequent dependencies,while enhanced dynamic task granularity resizing can reduce the control overhead and optimize the global overhead of the loops with changing characteristics of dependencies.All these three optimization techniques have been implemented in HEUSPEC~a software TLS system.Experimental results indicate that they can satisfy tile demands from different groups of benchmarks.The combination of these techniques can improve the performance of all benchmarks and reach a higher average speedup. 展开更多
关键词 parallel programming model optimization thread level speculation HEUSPEC performance
暂未订购 下载PDF
大数据文件和混合文件的多线程并行下载 认领 引用 被引量:8
5
作者 韦兴柳 钟诚 +2 位作者 李智 蔡德霞 陈清媛 《计算机工程与应用》 CSCD 2012年第14期84-89,共6页
在应用计算机模拟病例训练与考试系统的过程中,客户端时常需要在线下载许多大数据文件、音频和视频混合文件,系统响应速度是一个关键问题。研究了在RIA中实现多线程的技术方案,提出在多核计算机上有效实现多线程并行下载大数据文件、音... 在应用计算机模拟病例训练与考试系统的过程中,客户端时常需要在线下载许多大数据文件、音频和视频混合文件,系统响应速度是一个关键问题。研究了在RIA中实现多线程的技术方案,提出在多核计算机上有效实现多线程并行下载大数据文件、音频和视频混合文件的优化方法。算法分析与实验结果表明,提出的多线程并行下载技术能够加速计算机模拟病例系统模块的在线下载,显著优化了系统运行性能。 展开更多
关键词 多线程下载 性能优化 富互联网应用(RIA) 多核计算机 线程级并行性
暂未订购 下载PDF
单片多处理器的研究 认领 引用 被引量:7
6
作者 史莉雯 樊晓桠 张盛兵 《计算机应用研究》 北大核心 2007年第9期46-49,共4页
单片多处理器结构支持较高线程级的并行,能显著提高性能。介绍了单片多处理器的结构,对一些结构模型和实际的商用处理器进行举例,并对关键技术进行了研究分析。
关键词 单片多处理器 线程级并行 存储层次 核间互连 多核任务调度
暂未订购 下载PDF
多态并行机上的3D图形渲染 认领 引用 被引量:7
7
作者 韩俊刚 姚静 +4 位作者 李涛 黄虎才 乔虹 延酉玫 王鹏博 《西安邮电大学学报》 2015年第2期1-6,15,共6页
针对多态同构阵列处理器,提出一种图形算法并行化的实现方法。该方法通过分析图形流水线中渲染算法的控制依赖、数据依赖关系,并对各个算法计算量进行估计,利用多态阵列处理机的能够结合不同类型的并行计算的特点,以处理器的负载均衡为... 针对多态同构阵列处理器,提出一种图形算法并行化的实现方法。该方法通过分析图形流水线中渲染算法的控制依赖、数据依赖关系,并对各个算法计算量进行估计,利用多态阵列处理机的能够结合不同类型的并行计算的特点,以处理器的负载均衡为依据,实现图形渲染的并行化计算。实验结果表明,该方法所实现的加速比按线性增长。 展开更多
关键词 多态阵列机 并行计算 图形渲染 线程并行 操作并行 数据并行
暂未订购 下载PDF
一种基于路径优化的推测多线程划分算法 认领 引用 被引量:2
8
作者 李远成 赵银亮 +1 位作者 李美蓉 杜延宁 《软件学报》 EI CSCD 北大核心 2012年第8期1950-1964,共15页
推测多线程(speculative multithreading,简称SpMT)技术是一种实现非规则程序自动并行化的有效途径.然而,基于控制流图和分支预测技术的线程划分方法,不可避免地会受到划分路径上所存在的控制依赖和数据依赖的制约.目前,在传统的线程划... 推测多线程(speculative multithreading,简称SpMT)技术是一种实现非规则程序自动并行化的有效途径.然而,基于控制流图和分支预测技术的线程划分方法,不可避免地会受到划分路径上所存在的控制依赖和数据依赖的制约.目前,在传统的线程划分算法中存在的一个重要问题是,在对划分路径进行选取时只考虑了控制依赖影响却不能有效地综合考虑数据依赖的影响,进而导致不能选取最佳的划分路径.因此,针对传统方法中这种依赖评估方法效率低下的问题,设计并实现了一种基于路径优化的线程划分算法.该算法通过引入基于程序切片技术的预计算方法,建立一种路径评估方法来评估程序间的控制和数据依赖.同时,引入控制线程体大小的启发式规则,以便有效地解决负载不平衡的问题.基于Olden测试集的测试结果表明,所提出的算法可以有效地对非规则程序进行划分,其平均加速比可以达到1.83. 展开更多
关键词 推测多线程 线程级并行 线程划分 路径优化 自动并行化
暂未订购 下载PDF
针对子程序结构的线程级推测并行性分析 认领 引用 被引量:6
9
作者 梁博 安虹 +1 位作者 王莉 王耀彬 《小型微型计算机系统》 北大核心 2009年第2期230-235,共6页
线程级推测技术为开发更多的线程级并行性,充分利用多核加速传统上难以手工或自动并行化的串行程序提供可行的技术途径.然而,这种技术的性能严重地依赖于线程划分方案.有研究表明,仅推测执行循环所产生的并行性是不够的,但推测执行子程... 线程级推测技术为开发更多的线程级并行性,充分利用多核加速传统上难以手工或自动并行化的串行程序提供可行的技术途径.然而,这种技术的性能严重地依赖于线程划分方案.有研究表明,仅推测执行循环所产生的并行性是不够的,但推测执行子程序结构比循环结构要难.本文提出寻找适于推测并行执行的子程序结构的基本判定依据;通过运行由Simplescalar工具集改造得到的动态剖析工具ProRV、ProFun和SPEC CPU2000基准测试程序,我们对子程序结构线程化推测执行的适合性进行详细分析,给出具有指导意义的实验分析方法和实验数据.我们发现:1无返回值的子程序结构占据程序整体执行时间的大约40%;返回稀疏整型的子程序结构占据了程序整体执行时间的大约10%,对其返回值的预测成功率在70%左右.对于其他返回值类型的子程序结构,由于对其返回值的预测成功率过低,我们认为不适合作为线程划分的对象.2简单的last-value的值预测方案对于返回值的预测是简单而且足够有效的.3访存数据依赖普遍存在于子程序与其后继代码之间,显式同步机制对于针对子程序结构的线程级推测是必要的. 展开更多
关键词 线程级推测 串行程序自动并行化 子程序结构 动态剖析 数据依赖分析
暂未订购 下载PDF
NNW-TopViz流场可视分析系统 认领 引用 被引量:7
10
作者 陈呈 赵丹 +4 位作者 王岳青 邓亮 杨超 苏铖宇 王昉 《航空学报》 EI CAS CSCD 北大核心 2021年第9期238-249,共12页
流场可视化技术采用图形图像直观地表现CFD数值模拟的计算结果,使用户能够方便地对这些数据进行分析、比较和研究。然而,CFD数值模拟的流动复杂,其产生的流场数据规模巨大、数据类型复杂、特征提取困难,传统的串行可视化软件效率低、交... 流场可视化技术采用图形图像直观地表现CFD数值模拟的计算结果,使用户能够方便地对这些数据进行分析、比较和研究。然而,CFD数值模拟的流动复杂,其产生的流场数据规模巨大、数据类型复杂、特征提取困难,传统的串行可视化软件效率低、交互手段单一,难以满足数据分析的需求。国家数值风洞(NNW)工程研制了一套流场数据处理可视化软件系统(NNW-TopViz,简称TopViz),具有对流场数据处理与特征提取、几何图形绘制等可视化与交互功能。根据可视分析效率需求,TopViz实现了线程并行,在多核计算环境下有效提高了可视化计算和交互效率;针对流场特征提取困难、常规方法效率低的问题,TopViz实现了基于卷积神经网络的流场旋涡特征提取方法,提升了特征提取准确率和效率;为提高软件交互效率并提供便捷的交互方式和体验,基于头戴式显示设备和体感控制器构建沉浸式虚拟显示与交互平台,TopViz实现了手势和眼球凝视2种交互方法,提供沉浸式环境下多视图、多角度流场探测方式。 展开更多
关键词 流场可视化软件 国家数值风洞工程 线程并行可视化算法 智能特征提取 虚拟现实 NNW-TopViz软件
暂未订购 下载PDF
基于Syntax级分组和多线程处理的HEVC熵编码并行算法 认领 引用 被引量:2
11
作者 邸金红 张克新 +1 位作者 祁跻 张鑫明 《电讯技术》 北大核心 2014年第10期1435-1440,共6页
新一代视频编码标准HEVC获得了较高的编码效率,但是同时需要较大的计算量。HEVC并行算法能够提高编码速度,如何开发适用于多核处理器的并行编码算法对于满足高清视频实时传输和大规模共享具有十分重要的意义。提出了一种基于Syntax级... 新一代视频编码标准HEVC获得了较高的编码效率,但是同时需要较大的计算量。HEVC并行算法能够提高编码速度,如何开发适用于多核处理器的并行编码算法对于满足高清视频实时传输和大规模共享具有十分重要的意义。提出了一种基于Syntax级分组和多线程处理的HEVC熵编码并行算法。该算法首先将HEVC中一个编码树单元的编码信息按照语法元素进行分组;其次,根据编码块数据间的相关性构建Syntax级并行编码器;然后结合多线程技术实现HEVC帧级编码的并行计算。实验结果表明,在编码图像的主客观质量上没有太大损失的情况下,该并行算法框架与传统的串行算法框架相比具有65%~70%的加速效果。 展开更多
关键词 高效视频编码 并行算法 Syntax级 多线程
暂未订购 下载PDF
基于多核集群的RTI并行优化技术 认领 引用 被引量:2
12
作者 杨勇 姚益平 梁洪波 《系统仿真学报》 CAS CSCD 北大核心 2012年第9期1785-1789,共5页
随着基于高层体系结构HLA(High Level Architecture)仿真应用的不断深入,系统仿真规模不断扩大,仿真模型越来越复杂,仿真节点之间的交互更加频繁,使得仿真系统对通信资源与计算资源的需求不断提高。多核集群能够提供数据并行处理和高效... 随着基于高层体系结构HLA(High Level Architecture)仿真应用的不断深入,系统仿真规模不断扩大,仿真模型越来越复杂,仿真节点之间的交互更加频繁,使得仿真系统对通信资源与计算资源的需求不断提高。多核集群能够提供数据并行处理和高效通信的性能潜力,因此通过在多核集群上进行仿真加速正成为提高HLA仿真运行效率的重要途径。然而传统的仿真运行支撑平台RTI(Run Time Infrastructure)主要面向分布式网络环境,一般不支持并行通信和消息并行处理,从而难以发挥多核集群的高效通信和并行计算的性能优势。因此,为了提高多核集群下大规模HLA仿真的运行效率,提出了基于多通道的并行通信结构和基于消息分类的多线程处理技术,并已经应用于正在开发的并行shmRTI中,与国际同类商业软件pRTI1516进行的对比测试结果表明,性能可提升30%以上。 展开更多
关键词 多核集群 HLA RTI 并行通信 多线程
暂未订购 下载PDF
基于网络处理器的入侵检测方法 认领 引用 被引量:1
13
作者 魏利华 张晓明 +1 位作者 唐玉华 孙志刚 《计算机工程》 EI CAS 北大核心 2006年第7期160-162,共3页
入侵检测是网络安全的核心技术。随着网络速度的不断提升,现有NIDS的检测速度已不适应千兆位以上网络,漏检率和误检率越来越高。网络处理器以高度并行、硬件多线程、多级存储和灵活可编程等先进技术提供高速的数据包处理性能。该文对利... 入侵检测是网络安全的核心技术。随着网络速度的不断提升,现有NIDS的检测速度已不适应千兆位以上网络,漏检率和误检率越来越高。网络处理器以高度并行、硬件多线程、多级存储和灵活可编程等先进技术提供高速的数据包处理性能。该文对利用网络处理器解决入侵检测的速度瓶颈提出了观点、方法和策略,设计和实现了一个面向入侵检测的高速网络处理器原型。 展开更多
关键词 网络处理器 入侵检测 多级并行 硬件线程 调度策略
暂未订购 下载PDF
基于多核并行遗传算法并行生成测试用例 认领 引用 被引量:1
14
作者 陈清媛 钟诚 李智 《微电子学与计算机》 CSCD 北大核心 2013年第11期149-153,共5页
通过将种群划分为多个子种群,对每个子种群执行遗传操作,p个核心并行执行遗传算法搜索测试路径,以加速测试用例的生成;通过在处理核心之间迁移子种群的个体,使得交叉变异后得到的种群个体变得丰富,算法能更好地全局寻优,可以寻找到较多... 通过将种群划分为多个子种群,对每个子种群执行遗传操作,p个核心并行执行遗传算法搜索测试路径,以加速测试用例的生成;通过在处理核心之间迁移子种群的个体,使得交叉变异后得到的种群个体变得丰富,算法能更好地全局寻优,可以寻找到较多能够覆盖全部路径的测试用例.实验结果表明,与基于串行遗传算法生成测试用例相比,多核并行遗传算法并行生成测试用例能够生成较多覆盖全都路径的测试用例且运行时间少. 展开更多
关键词 测试用例生成 并行遗传算法 多核系统 线程级并行
暂未订购 下载PDF
选择性循环的并行方法 认领 引用 被引量:1
15
作者 吴悦 雷超付 杨洪斌 《计算机工程》 CAS 北大核心 2010年第9期35-37,40,共3页
针对含有大量循环的串行程序存在的问题,提出一种基于线程级前瞻技术的循环选择方案。该方案对循环进行最优选择后建立一个可并行运行的循环集。对于该集合中的循环,选择并行效率高的代码段作并行处理,以加快串行程序运行速度。实验表明... 针对含有大量循环的串行程序存在的问题,提出一种基于线程级前瞻技术的循环选择方案。该方案对循环进行最优选择后建立一个可并行运行的循环集。对于该集合中的循环,选择并行效率高的代码段作并行处理,以加快串行程序运行速度。实验表明,相对于一般的简单内部循环或外部循环并行方法,该方案使9种基准代码的加速比平均上升23.8%,从而提高串行程序并行运行的效率。 展开更多
关键词 线程级前瞻 循环选择 并行运行 单片多核处理器
暂未订购 下载PDF
非规则串行程序隐式线程级推测并行发展综述 认领 引用 被引量:2
16
作者 李远成 刘斌 《西安邮电大学学报》 2017年第1期99-105,共7页
基于片上多核处理器体系结构,概述在非规则串行程序自动并行化领域中,隐式线程级推测并行技术的特点、研究现状、以及所面临的挑战。从程序特征分析、多线程划分、软硬件协同加速方法和性能功耗评估等4个方面,探讨线程级推测技术未来的... 基于片上多核处理器体系结构,概述在非规则串行程序自动并行化领域中,隐式线程级推测并行技术的特点、研究现状、以及所面临的挑战。从程序特征分析、多线程划分、软硬件协同加速方法和性能功耗评估等4个方面,探讨线程级推测技术未来的发展趋势和研究方向。 展开更多
关键词 线程级推测 自动化并行 片上多核处理器 软硬件协同设计 非规则程序
暂未订购 下载PDF
GPGPU上基于运行时特征的动态并行度调度算法 认领 引用
17
作者 于玉龙 王宇新 郭禾 《小型微型计算机系统》 CSCD 北大核心 2015年第12期2798-2802,共5页
调度算法对于保障GPGPU内大规模并发线程的高效运行至关重要.调度器需要根据程序的计算特征和GPGPU内各种逻辑单元的设置情况选择合理的线程并行度.然而现有调度算法或采用静态固化并行度、或调整粒度过粗,均无法在动态调整的同时保持... 调度算法对于保障GPGPU内大规模并发线程的高效运行至关重要.调度器需要根据程序的计算特征和GPGPU内各种逻辑单元的设置情况选择合理的线程并行度.然而现有调度算法或采用静态固化并行度、或调整粒度过粗,均无法在动态调整的同时保持合理的并行度参数.基于两层次调度算法TL,通过对GPGPU运行时特征的动态监测,针对细粒度Warp调度提出了结合运行时资源使用特征和指令特征的动态并行度调度算法DTL和D2TL.在性能模拟器GPGPU-Sim上的仿真实验证明,相对传统TL调度算法,DTL和D2TL分别达到平均14.4%和19.6%的性能加速. 展开更多
关键词 GPGPU 两层次调度 线程级并行 动态并行度
暂未订购 下载PDF
基于线程集成的系统设计方法 认领 引用
18
作者 蒋书波 刘仲辉 程明霄 《计算机工程与设计》 北大核心 2008年第6期1380-1383,共4页
实现嵌入式系统任务的并行性是改善系统性能的基本手段。通过分析影响嵌入式系统性能的主要因素,采用了基于线程概念的嵌入式系统并行设计方法,利用指令级并行来改善系统性能。主要论述了线程集成的实现方法,通过编译技术在指令级代码... 实现嵌入式系统任务的并行性是改善系统性能的基本手段。通过分析影响嵌入式系统性能的主要因素,采用了基于线程概念的嵌入式系统并行设计方法,利用指令级并行来改善系统性能。主要论述了线程集成的实现方法,通过编译技术在指令级代码中融合多个线程,从而实现任务的并行性,并将该方法应用于仪器仪表显示模块的设计。 展开更多
关键词 嵌入式系统 线程集成 系统性能 并行设计 指令级
暂未订购 下载PDF
多通道组合阵列存储系统结构与并行I/O设计 认领 引用
19
作者 贺再红 周炎涛 《计算机工程与科学》 北大核心 2009年第7期68-71,101,共4页
本文基于开放硬件平台和软件环境提出了一种集成式多通道组合阵列存储系统结构;设计了多个阵列适配卡分条和卡上多个磁盘分条的两级并行数据组织和分布方式,以提高I/O访问的并发性;提出了一种将来自主机的I/O命令并行分散到多个阵列通... 本文基于开放硬件平台和软件环境提出了一种集成式多通道组合阵列存储系统结构;设计了多个阵列适配卡分条和卡上多个磁盘分条的两级并行数据组织和分布方式,以提高I/O访问的并发性;提出了一种将来自主机的I/O命令并行分散到多个阵列通道上的调度方法。实验表明,在10Gb/s的Infiniband主机接口通道下,组合阵列的I/O性能基本上是多个阵列适配卡I/O带宽的线性叠加。 展开更多
关键词 分布式冗余校验磁盘阵列 多通道组合 二级分条 并行I/O 多线程并行
暂未订购 下载PDF
多核架构下的数据处理算法优化策略综述 认领 引用 被引量:7
20
作者 陈伟 杜凌霞 陈红 《计算机科学与探索》 CSCD 2011年第12期1057-1075,共19页
多核处理器,尤其是单芯片多处理器(chip multi-processor,CMP)能够提供强大的共享内存的并行资源,然而单核处理器上的程序和算法并不能充分利用多核架构提供的并行计算资源,因此必须针对多核体系架构特点,对算法进行改进优化,提高算法... 多核处理器,尤其是单芯片多处理器(chip multi-processor,CMP)能够提供强大的共享内存的并行资源,然而单核处理器上的程序和算法并不能充分利用多核架构提供的并行计算资源,因此必须针对多核体系架构特点,对算法进行改进优化,提高算法的执行性能。以优化程序局部性、减少cache访问冲突、提高线程并行度、充分利用单指令多数据流(single instruction multipledata,SIMD)并行和带宽优化等几方面为出发点,归纳和分析了多核处理器上数据处理算法的相关优化策略,并对多核算法进行了总结评述。最后阐述了该领域亟待解决的诸多问题,展望了未来的研究发展方向。 展开更多
关键词 多核 单芯片多处理器(CMP) 数据级别并行(DLP) 线程级别并行(TLP) 单指令多数据流(SIMD)
暂未订购 下载PDF
上一页 1 2 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈