如何解决如何使用 Jsoup for android 从带有 CDATA 的标签 <content:encoded> 检索数据?
我想使用 jsoup 从 RSS 提要中检索数据。我可以使用所有标签,但是当有 content:encoded 标签时我不能这样做。请任何人帮助我如何从内容中获取数据:编码标签。 我的提要 URL 是 https://sambad.in/feed/,我的代码也是 Document doc = Jsoup.parse(String.valueOf(response)); 元素 itemElements = doc.select("item");
for (int i = 0; i < itemElements.size(); i++) {
Element item = itemElements.get(i);
String title = item.child(0).text();
String link=item.child(1).text();
String imgUrl=extractImageUrl(item.select("description").text());
String description = extractPostText(item.select("description").text())+"From Sambad: By Pin2";
String fullnews=extractPostText(item.children().select("http://purl.org/rss/1.0/modules/content/encoded").text());
解决方法
要使用的选择器将是 $
。要指定命名空间标记,请将 \
替换为 $ git branch -r --contains <commit-sha>
。有关更多示例,请参阅 jsoup selector documentation。
这是 Try Jsoup 上的一个活生生的例子。
需要注意的几点:
- 对于 RSS,您应该使用 XML parser 而不是(默认)解析器。通常,如果您使用 Jsoup.connect(url) 加载内容,这会自动发生,因为它会根据内容类型设置解析器。但是您绕过了它(通过提供 String 输入),因此您需要手动指定它。
-
uploadpack.allowReachableSHA1InWant=true
选择器的结果将是一组包含 HTML 标记文本的元素(未解析的 HTML 元素)。那是因为 RSS 中的内容是 HTML 编码的(转义)。如果您希望将其作为已解析的 HTML,接下来应该对文本使用 Jsoup.parseBodyFragment(String) 方法。
版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 dio@foxmail.com 举报,一经查实,本站将立刻删除。