作者eddbloody (eddbloody)
看板java
标题[问题] 有关Html Parser 的table问题
时间Mon Apr 25 01:47:36 2011
最近因为在研究Parser
看板上蛮多推荐Html Parser,就开始研究了一下这套
而我却碰到了一个问题
假如是单一的Tag,只要对个别处理就好
但是遇到Tag里面有Tag
就不太了解要怎麽做了..
如
<table>
<tr>
<td><a>TEXT</a></td>
</table>
我想要得知TEXT内容
P.S 我遇到的网页很奇怪的<tr>没有另外一组</tr>
但似乎使用TableTag时,没遇到问题XD
(不知道是不是运气好刚好没问题)
只会傻傻的用indexof + substring ,来硬作
虽然可以解决问题,但是总觉得这样硬作好像不太好
感觉只要HTML在多点变化,就会发生问题
所以来JAVA板问问各位高手
有甚麽办法可以找出TEXT内容
以下为部分的程式码(不太会排板 所以用贴的XD)
http://pastie.org/1828786
http://nopaste.info/dc49ee48cd.html
P.S 另外想问一下
总觉得我程式码排版都有点乱
当程式码过长的时候,各位会怎样分呢,还是直接一列这样?
如:
for(int k=0;k<((TableTag)(visitorList.getTags()[i])).getRows()[j].
getColumnCount();k++)
很少来JAVA板问,所以有点紧张XD
问题有点多 请见谅@@
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 111.242.2.185
※ 编辑: eddbloody 来自: 111.242.2.185 (04/25 01:51)
1F:→ Dannvix:用多个变数把很长的那一行折解出来 04/25 14:19
2F:→ Dannvix:例如 int columnCount = ...; 可以参考《Clean Code》 04/25 14:21
3F:→ eddbloody:最後只好取出table的值 在丢入LinkTag来处理~ 05/16 03:58