Partitioning Acceleration Between CPU and DRAM: A Case Study on Accelerating Hash Joins in the Big Data Era
-
摘要: 硬件加速器能够有效地提高当前计算机系统的能效.然而,传统的硬件加速器(如GPU,FPGA和定制的加速器)和内存是相互分离的,加速器和内存之间的数据移动难以避免,这使得如何降低加速器和内存之间数据移动的开销成为极具挑战性的问题.随着靠近数据的处理技术(near-data processing)和3D堆叠DRAM的出现,我们能够将硬件加速器集成到3D堆叠DRAM中,使得数据移动的开销大大降低.然而,由于3D堆叠DRAM对面积、功耗和散热具有严格的限制,所以不可能将一个功能复杂的硬件加速器完整地集成到DRAM中.因此,在设计内存端的硬件加速器时,应该考虑将加速任务在CPU和加速器之间合理地进行划分.以加速大数据系统中的一个关键操作hash joins为例子,阐述了CPU和内存端加速任务划分的设计思想.以减少数据移动为出发点,设计了一个包含内存端定制加速器和处理器端SIMD加速单元的混合加速系统,并对应用进行分析,将加速任务划分到不同的加速器.其中,内存端的加速器用于加速数据移动受限的执行阶段,而处理器端SIMD加速单元则用于加速数据移动开销较低成本的执行阶段.实验结果表明:与英特尔的Haswell处理器和Xeon Phi相比,设计的混合加速系统的能效分别提升了47.52倍和19.81倍.此外,提出的以数据移动为驱动的方法很容易扩展于指导其他应用的加速设计.
-
关键词:
- 3D堆叠内存 /
- 加速器 /
- 大数据 /
- hash joins /
- radix joins算法的优化版本 /
- hash分区加速器
Abstract: Hardware acceleration has been very effective in improving energy efficiency of existing computer systems. As traditional hardware accelerator designs (e.g. GPU, FPGA and customized accelerators) remain decoupled from main memory systems, reducing the energy cost of data movement remains a challenging problem, especially in the big data era. The emergence of near-data processing enables acceleration within the 3D-stacked DRAM to greatly reduce the data movement cost. However, due to the stringent area, power and thermal constraints on the 3D-stacked DRAM, it is nearly impossible to integrate all computation units required for a sufficiently complex functionality into the DRAM. Therefore, there is a need to design the memory side accelerator with this partitioning between CPU and accelerator in mind. In this paper, we describe our experience with partitioning the acceleration of hash joins, a key functionality for databases and big data systems, using a data-movement driven approach on a hybrid system, containing both memory-side customized accelerators and processor-side SIMD units. The memory-side accelerators are designed for accelerating execution phases that are bounded by data movements, while the processor-side SIMD units are employed for accelerating execution phases with negligible data movement cost. Experimental results show that the hybrid accelerated system improves energy efficiency up to 47.52x and 19.81x, compared with the Intel Has well and Xeon Phi processor, respectively. Moreover, our data-movement driven design approach can be easily extended to guide the design decisions of accelerating other emerging applications. -
-
期刊类型引用(30)
1. 马超红,郝新丽,孟小峰,张旭康. 机器学习赋能的多维数据查询处理研究综述. 计算机学报. 2025(01): 100-123 . 百度学术
2. 姜璐璐,高锦涛. 面向机器学习的数据库参数调优技术综述. 计算机工程与应用. 2024(03): 1-16 . 百度学术
3. 刘帅,乔颖,罗雄飞,赵怡婧,王宏安. 时序数据库关键技术综述. 计算机研究与发展. 2024(03): 614-638 . 本站查看
4. 赖思超,吴小莹,彭煜玮,彭智勇. 数据库索引调优技术综述. 计算机研究与发展. 2024(04): 929-954 . 本站查看
5. 朱镕佳,杨宇轩,李振东,陈硕,唐朝阳,唐晓雨. 基于树莓派的智能零售系统设计. 现代信息科技. 2024(19): 189-192+198 . 百度学术
6. 蔡盼,张少敏,刘沛然,孙路明,李翠平,陈红. 智能数据库学习型索引研究综述. 计算机学报. 2023(01): 51-69 . 百度学术
7. 曹蓉,鲍亮,崔江涛,李辉,周恒. 数据库系统参数调优方法综述. 计算机研究与发展. 2023(03): 635-653 . 本站查看
8. 杨荣利,王伟,杨栋,周东阳. 基于两因素模糊时间序列的一次风机指标预测. 电子设计工程. 2023(07): 91-94+99 . 百度学术
9. 唐楚哲 ,王肇国 ,陈海波 . 机器学习方法赋能系统软件:挑战、实践与展望. 计算机研究与发展. 2023(05): 964-973 . 本站查看
10. 张政,段怡,高志峰,张欢. 机器学习在手术中液体治疗的应用. 中国数字医学. 2023(07): 81-85 . 百度学术
11. 杜维柱,张晓华,卢毅,王书渊,沈彦伶. 基于机器学习与数值预报技术的电网短期临近气象预警模型设计. 电子设计工程. 2023(19): 99-103 . 百度学术
12. 曹卫东,金超. 基于birch聚类的可更新机器学习索引模型. 计算机工程与设计. 2023(11): 3328-3334 . 百度学术
13. 王鹏. “智慧工会”实现路径. 科技资讯. 2022(02): 10-12 . 百度学术
14. 张静,农昌瑞,张海兵,张亚周. 基于深度学习的发动机叶片故障检测技术. 航空发动机. 2022(01): 68-75 . 百度学术
15. 孟小峰,余艳. 在跨学科交叉融合中深发展社会计算与社会智能. 计算机科学. 2022(04): 3-8 . 百度学术
16. 欧群雍,谭同德,冯学晓. 基于机器学习的软件定义网络数据流子序列匹配算法. 国外电子测量技术. 2022(04): 70-76 . 百度学术
17. 杜清华,张凯. 一种高效的跨平台工作流优化方法. 计算机工程. 2022(07): 13-21+28 . 百度学术
18. 姬莉霞,赵耀,马郑祎,赵润哲,张晗. 基于iForest-BiLSTM-Attention的数据库负载预测方法. 郑州大学学报(理学版). 2022(06): 66-73 . 百度学术
19. 张洲,金培权,谢希科. 学习索引:现状与研究展望. 软件学报. 2021(04): 1129-1150 . 百度学术
20. 潘璇,徐思涵,蔡祥睿,温延龙,袁晓洁. 基于深度学习的数据库自然语言接口综述. 计算机研究与发展. 2021(09): 1925-1950 . 本站查看
21. 蒙芳,翟建丽. 学习行为大数据可视化的网络数据库学习仿真. 计算机仿真. 2021(09): 216-220 . 百度学术
22. 陈镭. 基于机器学习的数据库系统自动调参研究. 软件导刊. 2021(11): 148-151 . 百度学术
23. 崔栋,温巧燕,张华,王华伟. QML:一种混合空间索引结构. 通信学报. 2021(12): 1-16 . 百度学术
24. 陶镇威. 基于机器学习的Oracle数据库故障预测技术探索. 现代工业经济和信息化. 2020(02): 70-71 . 百度学术
25. 桂树强,周实,张家季,耿欣. 基于BIM的轨道交通项目管理框架体系研究与实践. 人民长江. 2020(03): 147-152 . 百度学术
26. 宋雨萌,谷峪,李芳芳,于戈. 人工智能赋能的查询处理与优化新技术研究综述. 计算机科学与探索. 2020(07): 1081-1103 . 百度学术
27. 陈珂锐,孟小峰. 机器学习的可解释性. 计算机研究与发展. 2020(09): 1971-1986 . 本站查看
28. 唐吉深,覃少华. 大型数据库重复记录检测与优化研究. 现代电子技术. 2020(17): 77-81 . 百度学术
29. 蔡洪浩,罗应华,张荣鑫,杨喻淳. 基于机器学习的智能光电对抗系统. 电子技术与软件工程. 2020(13): 79-80 . 百度学术
30. 陶姿邑. 基于深度学习的数据库重复记录检测算法. 微型电脑应用. 2020(12): 174-176 . 百度学术
其他类型引用(33)
计量
- 文章访问数: 1486
- HTML全文浏览量: 1
- PDF下载量: 553
- 被引次数: 63