Поиск одинаковых файлов

По ссылке Как ускорить сравнение при поиске файлов дубликатов? нашел вот такой код:

import os
import hashlib

def find_duplicates(folder):
    duplicates = {}
    for dirs, subdirs, files in os.walk(folder):
        for name in files:
            file = os.path.join(dirs, name)
            file_hash = hashlib.sha1(open(file, 'rb').read()).digest()
            dup = duplicates.get(file_hash)
            if dup:
                try:
                    duplicates[file_hash][name].append(file)
                except KeyError:
                    duplicates[file_hash][name] = [file]
            else:
                duplicates[file_hash] = {name: [file]}
    return duplicates

if __name__ == '__main__':
    duplicates = find_duplicates('12')
    for h in duplicates:
        for file in duplicates[h]:
            if len(duplicates[h][file]) > 1:
                print('Файлы дубликаты: {}'.format(', '.join(duplicates[h][file])))

Пытаюсь запустить его в PyCharm, чтобы понять как работает программа, но ничего не получается. Может я что-то не так делаю? Помогите разобраться


Ответы (0 шт):