Я пытаюсь очистить RSS-канал, расположенный здесь.
В данный момент я просто пытаюсь разобраться с JSoup, поэтому следующий код: просто подтверждение концепции (или, по крайней мере, попытка ее реализации).
public static void grabShakers(String url) throws IOException {
doc = Jsoup.connect(url).get();
desc = doc.select("title");
links = doc.select("link");
price = doc.select("span.price");
}
Он идеально передает название каждого элемента. Выход каждой ссылки — это просто десять повторяющихся закрывающих тегов ссылок, и она никогда не находит никаких цен. Я подумал, что, возможно, проблема в CDATA, поэтому я преобразовал документ в html, удалил комментарии с помощью .replace, а затем преобразовал его обратно в документ для анализа, но безрезультатно. Будем очень признательны за любую информацию.
Следующий код я использую для распечатки каждого элемента:
for (Element src : price) {
System.out.println(src);
}
Подробнее здесь: https://stackoverflow.com/questions/148 ... with-jsoup