作者synre (TRYING)
看板java
标题[问题] 抓取 wretch 网页原始码
时间Wed Jul 4 17:32:14 2007
请问各位一个关於从 url 抓取 html 原始档的问题.
透过一下 java 程式码, 若将 URL 内的字串改为 "
http://www.google.com"
是可以抓得到 google 首页原始码的.
然而, 若要以相同的方法抓取无名的网页,
似乎没办法抓下来 ?
请问要如何修改才能取得无名网页的 html 档呢 ?
谢谢 ~
try {
URL html = new URL ("
http://www.wretch.cc/album/test");
InputStreamReader is = new InputStreamReader(html.openStream());
BufferedReader in = new BufferedReader(is);
while (in.ready()){
System.out.println(in.readLine());
}
} catch (Exception e) {System.exit(0);}
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 140.119.192.213