Инструмент с открытым исходным кодом для очистки дисков Mac, Windows и Linux.

Частью моей ежедневной рабочей рутины является переключение между macOS, Windows и Linux, и одним из самых сложных аспектов работы с этими системами является то, как это влияет на организацию моего хранилища. Файлы быстро размножаются, и на каждой системе у меня в итоге оказывается множество дубликатов. У меня есть скриншоты в разных папках по умолчанию; я загружал одни и те же документы несколько раз на одни и те же устройства; и у меня есть почти идентичные копии файлов, синхронизированных с облаком.

Инструмент с открытым исходным кодом для очистки дисков Mac, Windows и Linux.

Я обычно использую инструменты для очистки, которые кажутся более совместимыми с моей операционной системой, и даже когда они эффективны, сложно поддерживать одинаковые привычки на разных устройствах. Поэтому я обратился к dupeGuru, инструменту, который находит и удаляет дубликаты файлов. Он работает аналогично AllDup.Но это идеальный вариант, поскольку он не меняет поведение пользователей на разных платформах.

Как dupeGuru определяет, что два файла «идентичны»?

Логика сопоставления, обнаружившая дубликаты, прекратила поиск.

Выполняю сканирование своего диска.

Многие встроенные инструменты для очистки файлов пропускают множество файлов, поскольку ищут дубликаты по именам файлов. сервисная Система сопоставления на основе содержимого. Таким образом, она обходит стороной имя файла и анализирует его содержимое. Когда я увидел, как dupeGuru сортирует файлы по содержимому, я понял, что недооценивал количество дубликатов.

Когда я использую dupeGuru, я редко переключаю режимы, и если это происходит, то намеренно. Стандартной версии dupeGuru достаточно для большинства документов, архивов и случайного мусора, который у меня есть. Однако я использую музыкальную версию, если дубликаты аудиофайлов скрываются за различиями в метаданных, а если я изменяю размер или сжимаю изображения, то предпочтительнее становится версия для фотографий. Таким образом, общее правило — использовать стандартный режим для общей очистки диска и переключаться на другие режимы, когда у вас есть мусор, связанный с конкретными медиафайлами.

DupeGuru использует пороговое значение сходства, допускающее некоторую неоднозначность. 100% сходство означает, что файлы содержат данные, являющиеся точными копиями друг друга; чем ниже процент, тем меньше совпадений между файлами. Хотя я доверяю высоким процентам сходства для изображений, к документам я отношусь строже.

Проверка всего подряд — это самый быстрый способ получить бесполезные результаты.

Стратегия размещения папок, которая в конечном итоге сделала процессы проверки предсказуемыми.

Количество совпадений во время проверки dupeGuru

Первые результаты, полученные с помощью dupeGuru, были крайне запутанными. Но я понял, что причина кроется в моём методе использования. Я просто указывал на целую директорию и запускал программу. Обычно это давало гораздо больше совпадений, чем у меня хватало сил или уверенности, чтобы просмотреть. Это был случай, когда неверные данные приводили к неверным решениям, даже если сам инструмент был хорош.

В настоящее время я разделяю папки, которые хочу очистить, от тех, которым доверяю. Я назначаю определенные папки в качестве справочных, если они необходимы для хранения оригиналов, архивов или тщательно отобранных коллекций. Таким образом, при обнаружении дубликатов dupeGuru не предлагает удалить копии из справочной папки.

Я исключаю из сканирования определенные каталоги. Это каталоги, содержащие системные папки, пакеты приложений и менеджеры пакетов. Избегая этих мест, я значительно уменьшаю «шум». Кроме того, более узкая область сканирования обеспечивает более быстрые и четкие результаты. Это также избавляет от большей части умственной работы, связанной с принятием решения о том, что удалять.

Научитесь читать результаты поиска на DupeGuru, а не взаимодействовать с ними.

Колонки, на которые я обращаю внимание, и колонки, которые я в основном игнорирую.

Поначалу я много времени уделял анализу процента совпадений. Со временем я понял, что это может быть ошибкой, поскольку процент показывает только сходство, а не важность. Более важными элементами оказались размер, местоположение и нахождение конкретного файла в справочной папке. Внимательное изучение таблицы, а не немедленная реакция, позволили сделать удаление более точным.

Сортировка результатов по размеру позволяет мне в первую очередь обрабатывать дубликаты, занимающие больше всего места. Я также использую значения дельты при сканировании, ориентированном на медиафайлы, чтобы понять, что представляют собой эти файлы на самом деле, а пути к папкам дают мне представление о причинах появления некоторых дубликатов. Все это обеспечивает контекст, который упрощает принятие решений.

Однако настоящий прорыв — это предварительный просмотр файлов. Мне не нужно гадать о совпадениях, если я могу просто открыть их. Я не думаю, что предварительный просмотр dupeGuru идеально работает на всех операционных системах, но это все равно быстрый способ завоевать доверие. Доверяя тому, что я вижу, я снижаю риск при очистке. Если Мне нужен был способ освободить место в основном хранилище.Такая ясность помогает понять, от чего нужно избавиться.

Используйте dupeGuru одинаково на всех операционных системах.

Почему эта закономерность повлияла на частоту чистки моих жестких дисков?

Сканирование каталога на DupeGuru

Однако, преимущества dupeGuru выходят далеко за рамки его функциональности. Инструмент работает одинаково на всех используемых мной платформах: Linux, Windows и macOS. Дизайн, процесс сканирования и таблицы результатов согласованы, что помогает мне избежать откладывания уборки на потом только потому, что я работаю на другом компьютере.

dupeGuru работает с внешними накопителями одинаково, независимо от платформы. Я могу сканировать их, используя ту же логику атрибуции, и анализировать результаты с теми же методами аудита. dupeGuru также имеет интерфейс командной строки, что полезно, когда мне нужно выполнять повторяющиеся задачи или подключаться к удаленным сессиям, хотя графический интерфейс пользователя является моим предпочтительным вариантом для ежедневной очистки.

Я начал ценить многоплатформенную функциональность dupeGuru, когда после многих лет ручной синхронизации и копирования у меня появилась фотобиблиотека, распределенная по всем трем платформам. Это не было волшебным решением, но dupeGuru дал мне всю необходимую ясность, чтобы понять, что дублируется и где.

Чему учит длительное употребление?

Если вам необходимо выполнить масштабное сканирование, dupeGuru — не самый быстрый инструмент для очистки, и он может показаться громоздким при работе с очень большими дисками. Поэтому разбиение задач на более мелкие части является важной альтернативой. Хотя поначалу это может показаться медленнее, вы значительно выигрываете от простоты управления результатами.

Я стараюсь не сильно настраивать параметры музыки и изображений, так как это иногда может приводить к размытым совпадениям. Ужесточение пороговых значений сходства или возврат к настройкам по умолчанию исправляет эту проблему. Однако, главное преимущество — это стабильность работы на разных платформах. Очень похоже на инструменты для удаления дубликатов, такие как Czkawka..

 

Перейти к верхней кнопке