Распараллеливание алгоритма сравнения нечетких строк
Не получается представить в параллельном виде алгоритм сравнения нечетких строк с помощью метода с помощью библиотеки Numba. Каким образом это можно реализовать? Сталкиваюсь с множеством ошибок при попытке исправить проблему. Где data - массив строк, dataHash - массив хешей строк. Заранее благодарю!
@njit
def winnowing(data, dataHash, threshold=0.85):
for i in range(len(dataHash)):
for j in range(len(dataHash)):
if (i == j or dataHash[j] == None):
continue
if (jaccard(str(dataHash[i]), str(dataHash[j])) >= threshold):
dataHash[j] = None
data[j] = None
return(data)
Ошибки обычно вида:
numba.core.errors.TypingError: Failed in nopython mode pipeline (step: nopython frontend)
non-precise type array(pyobject, 2d, C)