Если строковое представление полного текста слишком велико для храниться в памяти одновременно, будет ли быстрее:
- a) Хешировать оба файла целиком, а затем проверить, чтобы увидеть если хэши идентичны
- б) Считывайте каждый файл по частям и сравнивайте их, пока не достигнете EOF или не обнаружите несоответствие.
Я ожидаю пару ответов «это зависит», так что, если вы хочу, чтобы некоторые предположения работали с:
- Язык C# в .NET
- Текстовые файлы имеют размер 3 ГБ каждая
- Хеш-функция — MD5.
- Максимальный объем «запасной» оперативной памяти — 1 ГБ.
Подробнее здесь: https://stackoverflow.com/questions/767 ... sets-of-th