面向大数据的可扩展正则采样并行排序算法
排序算法是计算机科学领域的一个基础算法,是大量应用的算法核心。在大数据时代,随着数据量的极速增长,并行排序算法受到广泛关注。现有的并行排序算法普遍存在通信开销过大、负载不均衡等问题,导致算法难以大规模扩展。针对以上问题,提出一种大规模可扩展的正则采样并行排序(scalable parallel sorting by regular sampling,ScaPSRS)算法,摒弃传统正则采样并行排序(parallel sorting by regular sampling,PSRS)算法中由一个进程负责采样的做法,转而让所有进程参与正则采样,选出p-1个分隔元素,将整个数据集划分成p个不相交的子集...
Na minha lista:
| Autor principal: | |
|---|---|
| Formato: | Artigo |
| Idioma: | Chinês |
| Publicado em: |
China InfoCom Media Group
2024-07-01
|
| Colecção: | 大数据 |
| Assuntos: | |
| Acesso em linha: | https://www.infocomm-journal.com/bdr/CN/10.11959/j.issn.2096-0271.2024021 |
| Tags: |
Sem tags, seja o primeiro a adicionar uma tag!
|
