Регулярное выражение для захвата символов u+xxxx (или \ uxxxx) в JavaJAVA

Программисты JAVA общаются здесь
Anonymous
Регулярное выражение для захвата символов u+xxxx (или \ uxxxx) в Java

Сообщение Anonymous »

I've been trying to create PDF using PDFBox and it fails with errors like,


java.lang.IllegalArgumentException: U+0083 is not available in this font's encoding: WinAnsiEncoding


I wanted to know Если бы я мог запечатлеть такие элементы, используя регулярное выражение, я попытался использовать, < /p>

(\\[a-z]00[0-9][0-9])
< /code>

, который, кажется, работает нормально, если я подтверждаю, использует regextool (например, Regexbuddy), но не работает на Java! Я пытался использовать Java Patterns и Matcher, но без успеха. То, что я сделал с сопоставлением рисунков, заключается в следующем, < /p>

import java.util.regex.Pattern;
import java.util.regex.Matcher;
public class MatcherFindStartEndExample {

public static void main(String[] args) {

String text =
"IMTECH Ã\u0083¢Ã\u0082Â\u0080Ã\u0093Â\u0083 " +
"ERCC Ã\u0099¢à PLANNED ";

String patternString = "(\\[a-z]00[0-9][0-9])";

Pattern pattern = Pattern.compile(patternString);
Matcher matcher = pattern.matcher(text);

int count = 0;
while(matcher.find()) {
count++;
System.out.println("found: " + count + " : "
+ matcher.start() + " - " + matcher.end());
}
}
}
< /code>

Текст, который у меня есть сейчас, появляется что -то вроде, < /p>


imtech ã \ u0083 ¢ ã \ u0082 \ u0080 \ u0093 \ u0083 ã \ u0099 /> < /blockquote>

Спасибо < /p>

Подробнее здесь: https://stackoverflow.com/questions/467 ... rs-in-java

Вернуться в «JAVA»