Поиск одинаковых файлов
По ссылке Как ускорить сравнение при поиске файлов дубликатов? нашел вот такой код:
import os
import hashlib
def find_duplicates(folder):
duplicates = {}
for dirs, subdirs, files in os.walk(folder):
for name in files:
file = os.path.join(dirs, name)
file_hash = hashlib.sha1(open(file, 'rb').read()).digest()
dup = duplicates.get(file_hash)
if dup:
try:
duplicates[file_hash][name].append(file)
except KeyError:
duplicates[file_hash][name] = [file]
else:
duplicates[file_hash] = {name: [file]}
return duplicates
if __name__ == '__main__':
duplicates = find_duplicates('12')
for h in duplicates:
for file in duplicates[h]:
if len(duplicates[h][file]) > 1:
print('Файлы дубликаты: {}'.format(', '.join(duplicates[h][file])))
Пытаюсь запустить его в PyCharm, чтобы понять как работает программа, но ничего не получается. Может я что-то не так делаю? Помогите разобраться