Поиск и удаление дубликатов. Как легко найти дубликаты ваших файлов в Windows и удалить их

Одним из самых быстрых способов забить жесткий диск — хранение дубликатов файлов. Наверняка многие даже не подозревают об их существовании… они могут иметь разное происхождение: случайные копии, множество одинаковых загрузок и так далее. Одно можно сказать точно — они действительно могут создавать вам некоторые проблемы.

Множество дубликатов создаются из-за необходимости держать файл в «безопасности»… например перед редактирование документа я мог сделать копию на всякий случай, а потом забыть… или у меня уже есть такой документ, а я его еще раз скачал из почты. К сожалению таких дублей может быть очень много и получается что вы забиваете свободное место бесполезной информацией.

С помощью этих инструментов вы можете вычислить и удалить дубликаты файлов за считанные минуты и освободить много ценного места на жестком диске. Я буду рассматривать только бесплатные утилиты, поэтому вы ничего не теряете!

Поиск дубликатов файлов. Обзор лучших инструментов

Эта утилита наверное мой фаворит в инструментах для поиска и удаления дубликатов, потому что имеет массу замечательных возможностей: Она является кросс платформенной, полностью бесплатная, а так же имеет продвинутый алгоритм меток и отбора.

Что такое не явные дубли? Несколько одинаковых файла могут иметь разное имя. Например у вас на компьютере может быть два файла: пример-файла.avi и пример файла(1).avi — утилитка это прекрасно понимает и тоже может пометить их как дубликат.

Кстати утилита имеет и другие издания: Music Edition и Picture Edition, оптимизированные для поиска дублей графических и аудио файлах — даже если они записаны в разных форматах. Это очень важно, ведь именно аудио и графические файлы наиболее часто становятся дублями.

Duplicate Files Finder представляет собой приложение, которое осуществляет поиск дублированных файлов (которые имеют одинаковое содержание, но не обязательно с таким же именем) и позволяет удалить пользователю ненужные файлы.

Duplicate Files Finder может находить только точные дубликаты. Принцип ее работы — перебор всех файлов на компьютере по размеру и сравнение их по содержанию. С одной стороны это логично, но это совсем печально для видео и графики (ведь они в зависимости от алгоритма сжатия могут иметь разный размер) , но для всего остального программа просто отличная.

Благодаря такому алгоритму сравнения Duplicate Files Finder работает гораздо быстрее своих конкурентов.

AllDup является мощным инструментов для поиска дубликатов созданный одним человеком, Michael Thummerer. Утилита имеет ряд настроек для поиска дублей из: имени файла, расширения и типа данных, даты создания и изменения и еще много разных параметров.

AllDup имеет много полезных функций и большую гибкость в условиях поиска дубликатов, однако за функционал нужно заплатить. Интерфейс тут совсем не дружелюбный и это может загнать неуверенного пользователя в тупик. Однако если вы сможете разобраться в программе, то это приложение будет хорошим инструментом для поиска повторяющихся файлов.

Duplicate Cleaner требует тонкой ручной настройки, прежде чем вы сможете использовать функционал данной программы на все сто процентов.

При ручной настройке вы можете выбрать в какой папке нужно найти дубли, а не сканировать весь компьютер как предлагают нам некоторые другие программы. В итоге вы можете эти дубли удалить, переместить их все в отдельную папку или вместо них создать ярлыки на единственный нужный файл. В целом впечатления положительные — так что рекомендую.

Если вы пользователь Windows, и хотите избавиться от бесконечных копий изображений, то SimilarImages будет вам как никогда кстати. Изображения на мой взгляд самый частый источник дублированного контента на компьютере. Я например знаю что у меня есть куча дублирующихся фотографий в разных папках… а учитывая их количество разбираться с ними вручную у меня нет никакого желания.

Программа имеет гибкие настройки и может обнаруживать неточные дубликаты — это особенно актуально из-за присутствия артефактов появившимся в процессе сжатия изображения.

Самое замечательное в SimilarImages — она показывает вам два изображения когда находит дубли, и вы можете сделать вывод — оставить их или удалить дубль.

Заключение

Все как в реальной жизни, когда ненужное барахло создает ужасный беспорядок в вашем доме, так и дубликаты файлов могут накапливаться на вашем жестком диске. Такие файлы очень трудно удалить, потому что вы о нем забыли, а обычные программы для очистки системы не найдут их — так как они обосновалить на винчестере на вполне законных основаниях.

Используйте программы которые я вам перечислил для поиска дубликатов файлов чтобы освободить место на вашем жестком диске. Если вы знаете о других утилитах — поделитесь с нами в комментариях.

Вконтакте

Иногда в повседневной компьютерной деятельности возникает задача найти дубликаты файлов. Причин для этого может быть множество: нехватка места на жестком диске, попытки уменьшить энтропию в своих файлах, разобраться со сброшенными в разное время фотографиями с фотоаппарата и множество других нужных случаев.

В сети можно найти большое количество программ, которые позволяют искать дубликаты файлов. Но зачем искать какие-то программы, если шикарный инструмент для такой работы обычно всегда под рукой. И называется этот инструмент Total Commander (TC ).

В этой статье я покажу все методы на основе Total Commander версии 8.5 , в этой версии поиск дубликатов файлов стал очень богат функционально.

!!!Маленькое важное отступление. Что нужно понимать под словом дубликат файла? Два файла ИДЕНТИЧНЫ только тогда, когда они полностью совпадают побитно. Т.е. любая информация в компьютере представлена последовательностью нулей и единиц. Так вот, файлы совпадают только тогда, когда у них полностью совпадает последовательность нулей и единиц, из которых эти файлы состоят. Все разговоры о том, что можно сравнить два файла по какому-либо другому признаку, глубоко ошибочны.

В TC есть два, различающихся по своей сути, метода поиска дублирующихся файлов:

  • Синхронизировать каталоги;
  • Поиск дубликатов;

Их особенность и применение лучше всего показать на примерах.

1.Синхронизация каталогов.

Данный метод применяется тогда, когда у вас две сравниваемые папки имеют идентичную структуру. Это обычно бывает во многих случаях, вот несколько из них:

  • Вы регулярно делали архив своей рабочей папки. Через какое-то время вам понадобилось выяснить, какие файлы были добавлены или изменены с момента создания архива. Вы распаковываете весь архив в отдельную папку. Структура папок в нем практически совпадает с рабочей. Вы проводите сравнение двух папок «исходной» и «восстановленной из архива» и легко получаете список всех измененных, добавленных или удаленных файлов. Пара несложных манипуляций — и вы удаляете из восстановленной папки все дубликаты файлов, которые есть в рабочей.
  • Вы работаете в папке на сетевом диске и регулярно делаете копию к себе на локальный диск. Со временем ваша рабочая папка стала довольно большой и время, затрачиваемое на полное копирование, стало очень большим. Чтобы не копировать каждый раз всю папку, можно сначала провести сравнение с резервной и скопировать только те файлы, которые были изменены или добавлены, а также удалить в резервной папке файлы, которые были удалены из основной.

Когда вы войдете во вкус, почувствуете всю предоставленную мощь этого метода, вы сами сможете придумать тысячи ситуаций, когда метод синхронизации каталогов окажет вам огромную помощь в работе.

Итак, как же все происходит на практике. Приступаем.

Предположим у нас есть основная папка «Рабочая» , в которой лежат файлы, с которыми происходит работа. И есть папка «Архив» , в которой лежит старая копия папки «Рабочая» . Наша задача найти в обеих папках дублирующиеся файлы и удалить их из папки «Архив» .

Открываем TC. В правой и левой панелях открываем сравниваемые папки:

Нажимаем меню «Команды»-«Синхронизировать каталоги…»


Открывается окно сравнения каталогов

Далее нам необходимо установить параметры сравнения. Ставим галочки в параметры «с подкаталогами», «по содержимому», «игнорировать дату»

  • «с подкаталогами» — будут сравниваться файлы во всех подкаталогах, указанных папок;
  • «по содержимому» — вот ключевая опция, которая заставляет TC сравнивать файлы ПОБИТНО!!! В противном случае, файлы будут сравниваться по имени, размеру, дате;
  • «игнорировать дату» — эта опция заставляет TC показывать различающиеся файлы, без попытки автоматического определения направления будущего копирования;

!!! Сравниваться будут файлы только с одинаковыми именами!!! Если файлы идентичны, но они имеют разное имя, то они не будут сравниваться!

Нажимаем кнопку «Сравнить». В зависимости от объёма файлов, сравнение может идти очень долго, не пугайтесь. В конце концов сравнение закончится и в нижней строке состояния(на рисунке секция 1) отобразится результат:


Если кнопки в секции «Показывать» (на рисунке секция 2) нажаты, то вы увидите результат сравнения для каждого файла.

— эта кнопка включает отображение файлов, которые есть в левой панели, но которых нету в правой;

— эта кнопка включает отображение идентичных файлов;

— эта кнопка включает отображение различающихся файлов;

— эта кнопка включает отображение файлов, которые есть в правой панели, но которых нету в левой;

Если у вас, изначально, все кнопки отображения выключены, то результат сравнения можно оценить только по строке состояния (на рисунке выше секция 1), в данном случае мы видим что сравнились 11 файлов, из которых 8 файлов являются одинаковыми, 2 файла различаются, и еще в левой панели имеется файл, которого нет в правой панели.

Для выполнения нашего задания необходимо оставить отображение только идентичных(одинаковых) файлов, поэтому все остальные кнопки отображения выключаем


Теперь у нас остались только идентичные файлы, и мы спокойно можем удалить их в папке «Архив» . Для этого выделяем все файлы. Проще всего это сделать нажатием универсальной комбинации CTRL+A . Или сначала выделить мышкой первую строчку, потом нажать на клавиатуре клавишу SHIFT и не отпуская ее выделить мышкой последнюю строчку. В результате у вас должно получиться вот так:

Заключительным шагом мы нажимаем правой клавишей мышки на любую строку и в открывшемся меню выбираем пункт «Удалить слева»

TC любезно переспрашивает нас о нашем желании,

и если мы нажимаем «ДА» , то он удаляет все помеченные файлы в папке «Архив» .

После этого, автоматически, происходит повторное сравнение двух папок. Если вам не нужно повторное сравнение, то процесс можно прервать, нажав на кнопку «Прервать» или нажать клавишу ESC на клавиатуре. Если повторное сравнение не было прервано, и мы включили все кнопки отображения, то мы увидим вот такое окно

Все. Поставленная задача выполнена. Все одинаковые файлы найдены и удалены в папке «Архив» .

Обучающее видео по теме

2.Поиск дубликатов.

Коренное отличие данного метода от метода синхронизации каталогов заключается в том, что TC игнорирует имена сравниваемых файлов. Фактически, он сравнивает каждый файл с каждым, и показывает нам идентичные файлы как бы они не назывались ! Такой поиск очень удобен, когда вы не знаете ни структуры папок, ни имен сравниваемых файлов. В любом случае, после поиска дубликатов, вы получите точный список идентичных файлов.

Поиск дубликатов я покажу на одной практической задаче, поиске дубликатов личных фотографий. Довольно часто вы сбрасываете в компьютер фотографии со своих цифровых гаджетов. Частенько ситуация запутывается, что-то сбрасывается по многу раз, что-то пропускается. Как быстро удалить файлы, сброшенные несколько раз? Очень просто!

Приступаем.

Предположим, вы всегда сбрасываете все свои фотографии в папку «ФОТО» на диске D. После всех сбросов папка имеет примерно такой вид:

Как видим, некоторые файлы находятся в папках, названных по дате съемки, некоторые сброшены в корень папки «_Новые» и «_Новые1»

Чтобы начать поиск дубликатов открываем в любой панели TC папку, в которой будем искать. В нашем случае это папка «ФОТО»

Далее нажимаем на клавиатуре комбинацию клавиш ALT+F7 или в меню выбираем «Команды»-«Поиск файлов»

Открывается окно стандартного поиска TC. Строку «Искать файлы:» оставляем пустой, тогда будут сравниваться все файлы.

Затем переходим на закладку «Дополнительно» и выставляем галочки «Поиск дубликатов:», «по размеру», «по содержимому» и нажимаем «Начать поиск» .


Поиск может идти ОЧЕНЬ долго, не надо этого пугаться, так как происходит огромное количество сравнений большого объёма файлов. При этом в строке состояния показывается процент выполнения

Когда поиск закончится, откроется окно результатов поиска, в котором нажимаем кнопку «Файлы на панель»


В окне поиска и в окне панели идентичные файлы собраны в секции, отделенные пунктирными линиям

В каждой секции отображается имя файла и полный путь к файлу. Имена ИДЕНТИЧНЫХ файлов могут быть абсолютно различными!
В данном случае видно, что одна и таже фотография записана ТРИ раза, причем два раза под одним именем(IMG_4187.JPG ) а третий раз эта фотография записана под совершенно другим именем(IMG_4187_13.JPG ).

Далее остается выделить ненужные одинаковые файлы и удалить их. Это можно делать вручную, выделяя каждый файл нажатием клавиши Ins . Но это долго и не эффективно. Есть более правильные и быстрые способы.

Итак, наша задача состоит в том, чтобы удалить повторяющиеся файлы в папках «_Новые» и «_Новые1» .
Для этого нажимаем на дополнительной клавиатуре, справа большую клавишу [+] . Обычно этой клавишей в TC выделяются файлы по маске. Эту же операцию можно сделать через меню «Выделение»-«Выделить группу»

Программа для поиска дубликатов файлов чаще всего необходима пользователям, хранящим на диске большое количество музыки, фото и документов.

И, хотя удалять такие лишние копии можно вручную, специализированные приложения способны сэкономить немало времени.

Особенно, если файлы расположены в разных папках или в .

Искать такие дубликаты можно с помощью универсального программного обеспечения или же рассчитанного на конкретный тип данных.

В первом случае повышается скорость поиска, во втором – увеличивается вероятность обнаружить все копии.

Содержание:

Универсальные приложения

Универсальные приложения для поиска копий, в основном, работают по принципу сравнивания размеров файлов.

И, так как вероятность совпадения количества байтов у разных фото практически равна нулю, одинаковые значения считаются признаком дубликата.

Иногда алгоритм предусматривает проверку имён – тоже важный параметр для поиска, тем более что одинаковые данные в большинстве случаев совпадают и по названию.

Преимуществами программ являются возможность найти с их помощью файлы любого типа и сравнительно высокая скорость работы. Недостаток – меньшая точность обнаружения.

Так, например, ни одна из таких утилит не посчитает дубликатом одну и ту же , сохранённую с различным разрешением.

1. DupKiller

А среди её преимуществ можно отметить:

  • простоту настройки;
  • установку нескольких критериев поиска;
  • возможность игнорировать некоторые файлы (с определённым размером или датой создания, а также системные или скрытые).

Важно: При обнаружении файлов с нулевым размером их не обязательно удалять. Иногда это может быть информация, созданная в другой операционной системе (например, Linux).

Рис. 4. Программа для оптимизации системы CCleaner может искать и дубликаты файлов.

5. AllDup

Среди преимуществ ещё одной программы, AllDup , можно отметить поддержку любой современной операционной системы Windows – от XP до 10-й.

При этом поиск ведётся и внутри скрытых папок, и даже в архивах.

Хотя сравнение информации по умолчанию происходит по названиям файлов, поэтому настройки желательно сразу же изменить.

Зато в процессе поиска каждый найдённый дубликат можно просмотреть, не закрывая приложение.

А при обнаружении копии её можно не только удалить, но и переименовать или перенести в другое место.

К дополнительным преимуществам приложения относится и полностью бесплатная работа в течение любого периода времени.

Кроме того, производитель выпускает ещё и портативную версию для того чтобы искать копии на тех компьютерах, на которых запрещена установка постороннего ПО (например, на рабочем ПК).

Рис. 5. Поиск файлов с помощью portable-версии AllDup.

6. DupeGuru

Ещё одним полезным приложением, проводящим поиск дубликатов с любым расширением, является DupeGuru .

Её единственный недостаток – отсутствие новых версий для Windows (при этом обновления для и MacOS появляются регулярно).

Впрочем, даже сравнительно устаревшая утилита для неплохо справляется со своими задачами и при работе в более новых ОС.

С её помощью легко обнаруживаются даже системные файлы, а меню интуитивно понятное и русскоязычное.

Рис. 6. Обнаружение копий с помощью утилиты DupeGuru.

Примечательно, что, кроме обычного универсального варианта, компания-производитель создала утилиту для поиска файлов определённого типа.

Существует отдельная версия для изображений и ещё одна для музыки.

И, при необходимости очистить свой компьютер не только от документов и системных файлов (которые, кстати, требуется удалять очень осторожно – иногда стоит даже оставить «лишнюю» копию, чем нарушить работоспособность системы), стоит скачать и эти приложения.

7. Duplicate Cleaner Free

Утилита для обнаружения копий любого файла Duplicate Cleaner Free отличается следующими особенностями:

  • фильтрации данных по расширению;
  • русским языком интерфейса;
  • возможность бесплатного использования;
  • высокой скоростью работы.

К её недостаткам относят небольшие ограничения при поиске изображений (для этого рекомендуется приобрести платную версию) и не совсем точный перевод отдельных элементов меню .

Тем не менее, благодаря своей эффективности и удобству использования, приложение пользуется определённой популярностью.

Рис. 7. Поиск дубликатов с помощью утилиты Duplicate Cleaner Free.

Поиск дубликатов аудио файлов

Если результаты поиска дубликатов не устраивают пользователя, можно рассмотреть вариант, предназначенный для определённых файлов. Например, для , скопившейся на диске.

Такая необходимость часто возникает при загрузке сразу нескольких альбомов и сборников одного и того же исполнителя – нередко в разных папках оказываются одинаковые треки.

Они могут иметь похожие размеры и отличаться, по большому счёту, только названиями. Специально для этого существуют утилиты для поиска похожих мелодий.

8. Music Duplicate Remover

Среди особенностей программы Music Duplicate Remover – сравнительно быстрый поиск и неплохая эффективность.

Фактически, это приложение как бы «прослушивает» композицию и проводит её сравнение с другими аудио файлами.

При этом, естественно, время её работы больше, чем у универсальных утилит.

Однако количество проверяемых программой данных, как правило, в десятки раз меньше, поэтому средняя продолжительность проверки редко превышает пару часов.

Рис. 8. Обнаружение копий музыки и аудио файлов по альбомам.

9. Audio Comparer

При этом анализ фото тоже длится дольше по сравнению с поиском файлов любого расширения, но результат оправдывает себя.

Изображения определяются даже в том случае, когда на диске находятся несколько дубликатов одной картинки, но с разным разрешением и, соответственно, размером.

Кроме того, для повышения эффективности проверяются файлы с любыми графическими расширениями – от до.png.

Рис. 11. Поиск картинок с помощью ещё одной версии DupeGuru.

12. ImageDupeless

При этом она распространяется бесплатно и имеет русский интерфейс. А производитель периодически выпускает к ней обновления, повышая эффективность поиска изображений.

Рис. 12. Стильный интерфейс приложения ImageDupeless.

13. Image Comparer

Преимуществами приложения Image Comparer , кроме простого интерфейса, можно назвать наличие пошагового мастера, позволяющего научиться быстрому и результативному поиску изображений.

Эта особенность отличает утилиту от большинства остальных, для работы с которыми придётся читать файлы справки, не всегда правильно переведённые (а иногда и вообще предоставляемые только на английском).

Фактически, приложение является ещё одной версией Audio Comparer, и тоже распространяется по «условно бесплатной» лицензии – то есть за определённые функции пользователю придётся заплатить.

Рис. 13. Приложение Image Comparer – неплохой способ найти дубликаты картинок.

Здравствуйте Друзья! В этой статье мы разберемся как можно осуществить поиск дубликатов файлов на наших компьютерах. Признаюсь, у меня такой проблемы не стоит. Обычно, на моем компьютере три раздела. Первый системный от 50 до 100 ГБ, второй для документов от 100 до 200 ГБ и третий раздел для всего остального. У меня одна папка для фото, одна для музыки и так далее. Все прозрачно. Другое дело компьютер родителей. Жесткий диск разбит там на три части. На 3-ем разделе две или три папки с фотографиями + в каждой папке куча подпапок. На диске D так же в последствии образовалась папка фото. Перебирать все в ручную тяжело и тут нам помогут программы для поиска дубликатов файлов.

Мне не хочется устанавливать отдельную программу для какой-то функции так как функций бывает много (например дефрагментация или тот же поиск одинаковый файлов). Соответственно много программ придется ставить на компьютер . Позиция у меня следующая. Чем меньше устанавливаешь, тем надежнее и стабильнее работает компьютер .

Решения есть. Найти программу, которая практически необходима в обслуживании компьютера (то есть скорее всего будет установлена) и которая бы смогла искать дубли файлов. Искать долго не пришлось. Это уже знакомый и проверенный CCleaner от компании Piriform. Начиная с 4-ой версии в CCleaner прикрутили данную функцию и ниже мы посмотрим как она работает.

Программу, качаем с официального сайта

Устанавливаем.

При первом запуске выйдет окошко приведенное ниже. Если выбрать Да, то при очистке компьютера по умолчанию, возможно, не собьется авторизация на приведенных почтовый cервисах. Нажимаем Да

Переходим, слева, на вкладку Сервис

Нажимаем на кнопку Поиск файлов

Для поиска одинаковых файлов осталось только указать нужные настройки

Настроек не много и разбиты они на три группы:

  • Совпадение
  • Пропуск
  • Место где искать и места исключения

Остановимся на каждой группе подробнее

Совпадение

Можно установить поиск файлов дубликатов по Имени, Размеру, и Дате изменения. Так же можно комбинировать эти критерии устанавливая больше одной галочки. При упорядочивании фото на компьютере родителей первым делом произведу поиск с совпадением по Имени. Скорее всего найдется куча файлов сохраненных в различных местах. Затем, интересен будет поиск с совпадением по Размеру. Так как фото может быть переименовано, но размер не должен измениться.

Как эффективно использовать поиск дублей с включенной галочкой Изменен мне пока не пришло в голову. Если у вас есть варианты отпишитесь пожалуйста в комментариях. Возможно, если вы взяли и дорисовали что то в фото, при этом не поменяв имя. Но, в этом случае, с огромной вероятностью, изменится размер.

Пропуск

Какие файлы необходимо пропустить при поиске дублей. Здесь возможны следующие варианты:

  • Байты с размером 0
  • Файлы только для чтения
  • Размер менее х МБ
  • Системные файлы
  • Скрытые файлы

Место где искать и места исключения

Здесь с помощью кнопки Добавить на вкладке Включения задаете где искать дубликаты файлов. На вкладке Исключения добавляете места на жестком диске , флешке или на внешнем жестком диске , где не производить поиск.

В принципе все просто. Для сброса настроек нажимаете соответствующую кнопку.

Когда фильтр настроен нажимаете Найти.

Сортировка результатов поиска дубликатов файлов

В результате получается удобная для просмотра таблица с результатами поиска. Причем таблица формируется сразу, при обнаружении какого-либо дубля.

Предполагаемые дубликаты разделены между собой. Единственное, что хотелось бы видеть в этой таблице, сортировка по нажатию на какой-либо столбец.

При нажатии на файле правой кнопкой мышки появляется контекстное меню, которое позволяет удобно отсортировать результаты поиска. Это особенно актуально если результатов много.

Пункт Исключить позволяет убрать все файлы из выбранной вами папки. Например C:\Program Files. Пункт Ограничить оставит в результатах поиска только файлы из выбранной вами папки. Опция Выбрать дубликаты позволяет выбрать все файлы находящиеся в выбранной вами папке. Остальные пункты вроде бы понятны.

Очень полезен пункт Открыть папку. С помощью него можно быстро зайти и посмотреть где находится файл и нет ли там еще одинаковых файлов не попавших в таблицу результатов или отсеявшихся сортировкой.

Осталось вычислить какой из файлов нужно оставить, а остальные удалить воспользовавшись кнопкой справа внизу.

Заключение

Вот так с помощью старой доброй CCleaner собираюсь искать дубликаты файлов на своих и не только компьютерах . Для моих целей функционала программы достаточно. Если вам нужно больше, тогда стоит обратить внимание на DupKiller. Эта бесплатная программа, почитать о ней и скачать ее можно с официального сайта http://dupkiller.com/index_en.html . DupKiller имеет на много более широкие возможности выполнить настройку поиска. Так же там реализован просмотр графических файлов и прослушивание аудио. Интересна возможность задания не точного совпадения файлов, а до определенного уровня (процента).

Благодарю за то, что поделились статьей в социальных сетях. Всего Вам Доброго!



Просмотров