【发布时间】:2014-04-29 11:51:13
【问题描述】:
我有 1000 行的 HTML 代码,我想提取写在 HTML 标签之外的数据。
例如..
<>Java Programm<>
它应该只读取“Java Programm”并转义写在“”标签内的任何内容
我尝试了以下代码,但它正在读取包括 在内的整个数据,但我的输出中不需要“”。
public static void main(String[] args) throws Exception {
try {
FileInputStream fin = new FileInputStream("C:\\Users\\File.txt");
int i;
while ((i=fin.read())!=-1) {
System.out.print((char)i);
}
} catch (Exception e) {
// TODO Auto-generated catch block
e.printStackTrace();
}
}
【问题讨论】:
-
好的,你正在阅读文本文件。您尝试过什么来实际解决您的特定问题(忽略标签)?
-
@Adriano:OP 没有尝试任何东西,他只是发布了问题。只需复制文件读取代码并进一步为我们..
-
提示:将其读取为 XML(谷歌在 java 中读取 xml)。使用 element.getTextContent 获取标签外的数据...
-
@Hirak 我没明白..
标签: java html string file-io substring