Как мне создать блок данных из таблицы?

У меня есть функция, которая делает снимок, и дата-кадр в качестве входного. Я делаю вычисления сходства между элементами в этой таблице и элементами в датафрейме. Я хотел бы хранить результаты в колонках для каждого из элементов в датафрейме.

def compute_similarity(references, target):

    # I want to create as many rows as there are references and fill them with the results
    # arccos based text similarity (Yang et al. 2019; Cer et al. 2019)
    for row in target.iterrows():
        for reference in references:
            sim = 1 - np.arccos(
            result = sklearn.metrics.pairwise.cosine_similarity(row,
                                                                reference))/np.pi
        # place the result in the column "reference"

Por ejemplo con references:

array(['Agriculture, farming and environment',
       'Accountancy], dtype=object)

И датафрейм target:

0                                       Chef de projet
1                                             ASSUREUR
2                                 FONCTIONNAIRE D'ÉTAT
3                                      cadre supérieur
4                                        fonctionnaire
5                                         CDB Retraite
6                                           professeur
7                                       Chef de projet
8                                           مدير  شركة

мне бы хотелось:

    new_professionactuelle  Agriculture, farming and environment    Accountancy, banking and finance
0   Chef de projet          2.205516                                -0.989579
1   ASSUREUR                -0.982828                               0.826499
2   FONCTIONNAIRE D'ÉTAT    -0.163224                               0.206288
3   cadre supérieur         -0.272837                               1.406747
4   fonctionnaire           0.519358                                -0.922361

Ответы (0 шт):