Я использую библиотеку Jexcel для чтения электронных таблиц Excel. Каждая ячейка может содержать строки локализации на любом из 44 языков. Я не говорю API кодирование для использования. Он обрабатывает китайский язык, но облажается португальским и немецким. Кодирование по умолчанию (Macroman on My Dev Box, UTF-8 в производстве) не может должным образом интерпретировать строки, которые он вытаскивает из рабочей книги Excel. Есть ли мета-дата рабочей книги, я могу спросить, что это за набор персонажей? Если я запускаю все ячейки через jChardet, может ли он божественный кодирование персонажей для всей рабочей книги (основано на первом вопросе: «Да, все укусы в рабочей книге кодируются с одним и тем же набором символов»)?
Подробнее здесь: https://stackoverflow.com/questions/744 ... o-decode-i