Инструменты
Удалить дубликаты фотографий онлайн
До 100 фото за раз: сервис уберёт точные дубликаты среди снимков и отдаст ZIP только с уникальными изображениями.
Диск забит под завязку, а разбираться в тысячах файлов вручную нет ни времени, ни желания? Чаще всего виноваты не «тяжёлые» новые данные, а копии старых: одна и та же фотография из облака и с телефона, дважды скачанный установщик, резервная папка, которую забыли удалить. Разбираем, как отличить настоящий дубликат от файла с похожим именем, какими средствами Windows и macOS искать копии без установки программ и какие бесплатные утилиты делают это быстрее.

Дубликаты файлов появляются почти незаметно: облачная синхронизация (Google Диск, Яндекс Диск, iCloud) загружает фото и с телефона, и с компьютера, при переносе архива со старого ноутбука копируется папка, которая уже была скопирована раньше, а нужный документ иногда скачивают повторно, потому что забыли, что он уже есть. По отдельности такие копии незаметны, но за пару лет активного использования компьютера они способны занять десятки гигабайт. Прежде чем удалять что-либо, стоит разобраться, что вообще считать дубликатом — это не всегда файл с одинаковым именем, а иногда полезно заодно свериться и по контрольной сумме файла, чтобы убедиться, что копии действительно идентичны.
Коротко: настоящий дубликат — это файл с одинаковым содержимым (его подтверждает хэш-сумма), а не просто похожее имя или размер. В Windows и macOS есть встроенные способы найти повторы без установки программ — сортировка по размеру и поиск по маске. Для больших объёмов удобнее бесплатные утилиты вроде AllDup или dupeGuru, а для автоматизации — PowerShell. Перед удалением всегда проверяйте, что перед вами точная копия, а не похожий, но другой файл.
Самая частая ошибка при поиске повторов — судить о дубликате по имени файла. otchet.docx и otchet (1).docx действительно похожи и почти всегда оказываются копиями, но это не гарантия: файл могли переименовать после правок, и содержимое давно разошлось. Обратная ситуация тоже возможна — два файла с совершенно разными именами (IMG_2026.jpg и отпуск_фото.jpg) могут быть побайтово идентичны, если один просто переименовали при копировании.
Размер файла — чуть более надёжный признак, но тоже косвенный: у двух разных документов размер может случайно совпасть, особенно если это короткие текстовые файлы или изображения одного формата и разрешения. Единственный способ убедиться, что перед вами именно дубликат, а не просто похожий файл, — сравнить их содержимое, а не метаданные. Программы для поиска дубликатов и делают это в два этапа: сначала быстро группируют файлы по размеру (это дёшево вычислительно), а затем для файлов одинакового размера точно сверяют содержимое по контрольной сумме.
Контрольная сумма (хэш) — это короткая строка фиксированной длины, которую вычисляет специальный алгоритм (чаще всего SHA-256 или MD5) из полного содержимого файла. Если хэши двух файлов совпадают — с практической точки зрения это гарантия, что их содержимое идентично, вплоть до последнего бита. Если хэши разные — файлы отличаются, даже если внешне выглядят одинаково.
Именно так и работают программы для поиска дубликатов «под капотом»: они не сравнивают файлы напрямую байт за байтом (это было бы медленно для больших объёмов), а считают хэш каждого файла и ищут совпадения среди хэшей — это быстрее на порядки. Если хотите проверить конкретную пару файлов вручную, например, перед тем как удалить один из двух похожих архивов, — подробная инструкция с командами для Windows, macOS и Linux есть в статье как проверить контрольную сумму файла.
Для быстрой ручной проверки «на глаз» двух-трёх файлов хэш — избыточно: проще сравнить размер и открыть оба файла. Хэш нужен, когда файлов много и проверять руками невозможно — тогда его считают программы автоматически.
Если дубликатов немного и они сосредоточены в одной-двух папках (например, в «Загрузках» или на рабочем столе), можно обойтись встроенными средствами Проводника Windows — без установки чего-либо.
отчет — Windows покажет все файлы, содержащие это слово, включая варианты с «(1)», «(2)» и датой в имени, которые Проводник и браузеры добавляют при повторном скачивании или копировании.Этот способ реалистичен для одной папки на несколько десятков файлов. Если речь о всём диске или тысячах фотографий — переходите к специализированным программам ниже.
Все программы ниже ищут дубликаты по содержимому (через хэш), а не только по имени, и бесплатны для личного использования.
| Программа | ОС | Поиск по содержимому | Особенности |
|---|---|---|---|
| AllDup | Windows | Да | Гибкие фильтры по типу файла, размеру и дате; можно искать не только точные, но и похожие имена; портативная версия без установки. |
| dupeGuru | Windows, macOS, Linux | Да | Кроссплатформенная, с отдельным режимом для похожих (не только идентичных) изображений и музыки; открытый исходный код. |
| CCleaner (модуль «Поиск дубликатов») | Windows, macOS | Да | Встроен в популярный инструмент очистки системы; удобен, если CCleaner уже установлен для других задач. |
| Duplicate Cleaner Free | Windows | Да | Наглядный предпросмотр найденных пар, автоматический выбор «файла для сохранения» по правилам (например, самый новый). |
Из перечисленных официальный сайт есть у AllDup — там же лежит актуальная версия для скачивания. Перед первым большим сканированием запустите программу в режиме предпросмотра (без автоматического удаления) и проверьте несколько найденных пар вручную — это убережёт от случайного удаления нужных файлов.
Если вы уже пользуетесь Get-FileHash для проверки контрольных сумм, тот же командлет пригодится и для поиска дубликатов — только теперь нужно посчитать хэш не одного файла, а всех файлов в папке, и найти совпадения. Команда ниже рекурсивно обходит указанную папку, группирует файлы по хэшу и выводит только те группы, где нашлось больше одного файла (то есть настоящие дубликаты):
# найти дубликаты в папке C:\Users\Ivan\Downloads и всех подпапках
Get-ChildItem -Path "C:\Users\Ivan\Downloads" -File -Recurse |
Get-FileHash -Algorithm SHA256 |
Group-Object -Property Hash |
Where-Object { $_.Count -gt 1 } |
ForEach-Object { $_.Group | Select-Object Path, Hash }Разберём по шагам: Get-ChildItem -Recurse собирает список всех файлов в папке и вложенных подпапках, Get-FileHash считает SHA-256 для каждого, Group-Object -Property Hash группирует файлы по совпадающему хэшу, а Where-Object { $_.Count -gt 1 } оставляет только группы из двух и более файлов — то есть отфильтровывает уникальные файлы. Полный синтаксис командлетов — в официальной документации Microsoft Learn по Get-FileHash.
Приведённая команда выводит список дубликатов на экран, но ничего не удаляет — это осознанно. Добавлять автоматическое удаление в скрипт для больших папок рискованно: одна ошибка в фильтре, и можно стереть не то. Просмотрите список и удаляйте лишние копии вручную.
Фотографии — особый случай. Помимо точных дубликатов (один и тот же файл скопирован дважды), в галерее часто накапливаются «почти одинаковые» снимки: несколько кадров одного момента, слегка обрезанная или повёрнутая версия того же фото, скриншот, пересохранённый в другом формате. Такие файлы имеют разное содержимое на уровне байтов, и хэш-сравнение из разделов выше их дубликатами не посчитает — здесь нужен визуальный, а не побайтовый анализ. Для этой задачи на сайте есть отдельный специализированный инструмент — удаление дубликатов фото: он принимает до 100 изображений за раз, находит точные повторы и отдаёт архив только с уникальными снимками, без загрузки лишнего на сторонние серверы.
Отдельная головная боль — облачные хранилища. Если на компьютере настроена синхронизация с Google Диском или Яндекс Диском и одновременно с этим фото или документы вручную загружаются через веб-интерфейс, велик шанс получить два экземпляра одного и того же файла в облаке — синхронизированную и загруженную вручную копии Google Диск и Яндекс Диск при этом не считают конфликтом и не объединяют их автоматически.
В обоих сервисах есть встроенный поиск похожих файлов: в Google Диске — раздел «Хранилище» → сортировка списка файлов по имени поможет визуально найти повторы; в Яндекс Диске — фильтр по типу файла и сортировка по размеру в разделе «Файлы». Полноценного автоматического поиска дубликатов, как в десктопных программах, ни один из сервисов пока не предлагает — приходится либо сортировать список вручную, либо синхронизировать локальную копию облачной папки на компьютер и прогонять её через одну из программ из таблицы выше.
В macOS нет встроенного инструмента для поиска дубликатов файлов (в отличие от фото — для них есть отдельный альбом «Дубликаты» в приложении «Фото», начиная с macOS Ventura). Для произвольных файлов на диске работают два подхода.
shasum -a 256 в Терминале, как описано в гайде по проверке контрольной суммы.Для дубликатов именно фотографий в родной библиотеке «Фото» на Mac проще воспользоваться встроенным альбомом «Дубликаты»: приложение само находит повторно импортированные снимки и предлагает объединить их в один файл с сохранением всех метаданных.
Если программа для поиска дубликатов предлагает удалить файлы из системных папок Windows (C:\Windows) или программных каталогов (Program Files) — остановитесь и разберитесь, что это за файлы, прежде чем соглашаться. Совпадение размера там нередко случайно.
Надёжный способ — сравнить их содержимое по контрольной сумме (хэшу): если хэш SHA-256 или MD5 у обоих файлов совпадает, содержимое идентично на 100%. Совпадение только имени или размера — лишь повод проверить, а не доказательство.
Да, для небольшого числа файлов в одной-двух папках — через сортировку по размеру и поиск по маске имени в Проводнике Windows или Finder на Mac. Для всего диска или тысяч файлов эффективнее специализированные программы вроде AllDup или dupeGuru.
Обычные программы из таблицы выше находят только точные побайтовые дубликаты. Для похожих, но не идентичных снимков (разные кадры одного момента, повёрнутые или обрезанные версии) нужен отдельный инструмент с визуальным сравнением — например, специализированный сервис удаления дубликатов фото на этом сайте.
Само по себе — да, если программа действительно нашла точные дубликаты по хэшу. Риск не в алгоритме поиска, а в области сканирования: если случайно указать системную папку, можно наткнуться на файлы, которые совпадают по размеру, но дубликатами не являются. Всегда проверяйте список перед удалением и не сканируйте системные каталоги целиком.
Десктопные программы для поиска дубликатов сканируют локальный диск, а не облако напрямую. Чтобы проверить облачную папку, синхронизируйте её на компьютер (или скачайте нужные файлы) и прогоните через программу как обычную локальную папку.
Встроенного инструмента для произвольных файлов в macOS нет (кроме фото — там есть альбом «Дубликаты» в приложении «Фото»). Для остальных файлов используйте вид «Список» в Finder с сортировкой по размеру или установите кроссплатформенную программу вроде dupeGuru.
Она считает контрольную сумму каждого файла один раз и группирует файлы по совпадающим хэшам автоматически — вручную сравнивать содержимое тысяч файлов попарно физически нереально, а PowerShell делает это за секунды даже для больших папок.