期刊文献+
共找到2篇文章
< 1 >
每页显示 20 50 100
大点数FFT在“申威26010”上的并行优化 被引量:1
1
作者 郭俊 刘鹏 +2 位作者 杨昕遥 张鲁飞 吴东 《浙江大学学报(工学版)》 EI CAS CSCD 北大核心 2024年第1期78-86,共9页
根据“神威·太湖之光”超级计算机所用国产“申威26010”处理器的架构特点和编程规范,提出针对大点数FFT的众核并行优化方案.该方案源自经典的Cooley-Tukey FFT算法,通过将一维大点数数据迭代分解为二维小规模矩阵进行并行加速.为... 根据“神威·太湖之光”超级计算机所用国产“申威26010”处理器的架构特点和编程规范,提出针对大点数FFT的众核并行优化方案.该方案源自经典的Cooley-Tukey FFT算法,通过将一维大点数数据迭代分解为二维小规模矩阵进行并行加速.为了解决矩阵“列FFT”的读写、转置和计算问题,提出“列均分-行连续”的读写策略,通过对数据进行合理的分配、重排、交换,结合SIMD向量化、旋转因子优化、双缓冲、寄存器通信、跨步传输等优化手段,充分利用了众核处理器的计算资源和传输带宽.实验结果显示,单核组64从核并行程序较主核运行FFTW库,可以达到最高65x、平均48x以上的加速比. 展开更多
关键词 神威·太湖之光 申威26010 快速傅里叶变换 Cooley-Tukey算法 众核并行
在线阅读 下载PDF
融合多尺度特征的残差车道线检测网络
2
作者 蒋源 张欢 +2 位作者 朱高峰 朱凤华 熊刚 《测绘通报》 CSCD 北大核心 2024年第10期71-76,共6页
针对车道线分布范围广、占像素少、特征不易提取的问题,本文构建了一种基于多尺度特征融合的残差车道线检测网络。首先,以残差双边网络为基础,采用双边特征聚合模块,利用语义分支的上下文信息指导同一阶段的细节分支的特征响应,并融合... 针对车道线分布范围广、占像素少、特征不易提取的问题,本文构建了一种基于多尺度特征融合的残差车道线检测网络。首先,以残差双边网络为基础,采用双边特征聚合模块,利用语义分支的上下文信息指导同一阶段的细节分支的特征响应,并融合两分支的信息;然后,针对不同阶段具有不同尺度,使用多尺度自适应特征对齐融合模块,构建采样前后偏移向量索引表,降低因简单采样而造成的细节信息缺失;最后,引入空间注意力机制,增强模型的长距离特征捕捉能力。试验结果表明,本文模型在3个公开数据集上均取得了良好效果,其中在CULane数据集上的准确度达77.89%,比目前主流算法高2%。 展开更多
关键词 车道线检测 双边分割网络 多尺度 注意力机制 端到端
在线阅读 下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部