Как мне создать блок данных из таблицы?
У меня есть функция, которая делает снимок, и дата-кадр в качестве входного. Я делаю вычисления сходства между элементами в этой таблице и элементами в датафрейме. Я хотел бы хранить результаты в колонках для каждого из элементов в датафрейме.
def compute_similarity(references, target):
# I want to create as many rows as there are references and fill them with the results
# arccos based text similarity (Yang et al. 2019; Cer et al. 2019)
for row in target.iterrows():
for reference in references:
sim = 1 - np.arccos(
result = sklearn.metrics.pairwise.cosine_similarity(row,
reference))/np.pi
# place the result in the column "reference"
Por ejemplo con references:
array(['Agriculture, farming and environment',
'Accountancy], dtype=object)
И датафрейм target:
0 Chef de projet
1 ASSUREUR
2 FONCTIONNAIRE D'ÉTAT
3 cadre supérieur
4 fonctionnaire
5 CDB Retraite
6 professeur
7 Chef de projet
8 مدير شركة
мне бы хотелось:
new_professionactuelle Agriculture, farming and environment Accountancy, banking and finance
0 Chef de projet 2.205516 -0.989579
1 ASSUREUR -0.982828 0.826499
2 FONCTIONNAIRE D'ÉTAT -0.163224 0.206288
3 cadre supérieur -0.272837 1.406747
4 fonctionnaire 0.519358 -0.922361