作者willieliao (Willie Liao)
看板java
标题Re: [问题] 从网站里抓日文字串然後存起来
时间Wed Feb 2 00:31:42 2011
因为日本网站很多都是用jis或shift jis
知道哪个网站的话先去看一下charset,比方说
2ch.net -> Right Mouse Click -> view source
...
<meta http-equiv="Content-Type" content="text/html; charset=shift_jis" />
...
然後把你的InputStreamReader编码改成
URL url = new URL(urltext);
BufferedReader in = new BufferedReader(new
InputStreamReader(url.openStream(), "Shift_JIS"));
这里有日文的网页讲的比较详细:
http://ash.jp/java/stream.htm
※ 引述《ficecmiraror (秘密ID)》之铭言:
: 我想写一个程式可以从日本网站里抓字串然後存起来~
: 但是在编码那里一直遇到问题@@~
: 一开始我是用
: URL url = new URL(urltext);
: BufferedReader in = new BufferedReader(new
: InputStreamReader(url.openStream()));
: 来抓~
: 但我发现存起来的字串都是乱码~
: 後来我想说用string来标订位移~
: 再用byte来read~read到目地时就存起来~
: 没想到日文字一个好像是3bytes?(似乎是shift_jis or JIS编码)
: 有人可以教一下要怎麽存吗QQ~
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 199.255.80.20