面向大数据的可扩展正则采样并行排序算法
排序算法是计算机科学领域的一个基础算法,是大量应用的算法核心。在大数据时代,随着数据量的极速增长,并行排序算法受到广泛关注。现有的并行排序算法普遍存在通信开销过大、负载不均衡等问题,导致算法难以大规模扩展。针对以上问题,提出一种大规模可扩展的正则采样并行排序(scalable parallel sorting by regular sampling,ScaPSRS)算法,摒弃传统正则采样并行排序(parallel sorting by regular sampling,PSRS)算法中由一个进程负责采样的做法,转而让所有进程参与正则采样,选出p-1个分隔元素,将整个数据集划分成p个不相交的子集...
Wedi'i Gadw mewn:
| Prif Awdur: | |
|---|---|
| Fformat: | Artigo |
| Iaith: | Chinês |
| Cyhoeddwyd: |
China InfoCom Media Group
2024-07-01
|
| Cyfres: | 大数据 |
| Pynciau: | |
| Mynediad Ar-lein: | https://www.infocomm-journal.com/bdr/CN/10.11959/j.issn.2096-0271.2024021 |
| Tagiau: |
Dim Tagiau, Byddwch y cyntaf i dagio'r cofnod hwn!
|
