作者bigpigbigpig (To littlepig with love)
看板Python
标题Re: [问题] 搜寻 nested list 中的字串
时间Sat Oct 25 07:33:32 2014
※ 引述《hohiyan (海洋)》之铭言:
: 大家好
: 我目前正在自学python,想请教是否有更好的方法来处理搜寻nested list中的资料。
: 例如一个 nested list 为 ft = [['a',10],['b',5],['c',11'],['d',3]]
: 题目为
: Function add() takes a single-character string and a ft, and modified the ft
: to increase the number of occurrences of that character by 1.
: 例如 add('a',ft) 会 return ft = [['a',11],['b',5],['c',11'],['d',3]]
: 而 add('i',ft) return ft = [['a',10],['b',5],['c',11'],['d',3],['i',1]]
: 第一个问题是若我想要确认某个字元是否已在这个nested list中,应该怎麽做?
: 我用 'a' in ft 会error,只知道可以用 'a' in ft[i]
: 所以我就先 flat(?) 这个 nested list 让它变成:
: ['a',10,'b',5,'c',11,'d',3] ← 但这样好像很笨?
: 第二个问题是怎麽改进这个function 的写法,下面是我目前的写法
: def add_occurrence(x, ft):
: nt = []
: new_ft = [x for y in ft for x in y]
: if x not in new_ft:
: nt += [x,1]
: ft.extend([nt])
: else:
: for L in ft:
: if x in L:
: L[1] += 1
: return None
: 看起来可能很笨,但因为我目前也只学到 list 相关的进度,
: 我想请问如何改善这个function的效率?
帮 mikapauli 大大整理一下:
def add_occurence(ch, ft):
keys = list(zip(*ft))[0]
if ch in keys:
ft[keys.index(ch)][1] += 1
else:
ft.append([ch,1])
return ft
: 可以怎麽改进这个 function 的写法?因为我觉得它的效率似乎不太好,
: 当我用它去跑一个很大的文件档(几万字的txt file),要跑上超过一分钟。
: 我总觉得一定是我写的function 太烂了所以才要跑这麽久 Orz...
: 在此先感谢各位高手。
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 111.243.149.233
※ 文章网址: http://webptt.com/cn.aspx?n=bbs/Python/M.1414193614.A.EB8.html
1F:→ mikapauli: 看来应该要先find,不然做了两次搜寻 10/25 08:31
那就改成下面这样 :)
def add_occurence(ch, ft):
pos = ''.join(list(zip(*ft))[0]).find(ch)
if pos != -1:
ft[pos][1] += 1
else:
ft.append([ch,1])
return ft
>>> ft = [['a',10],['b',5],['c',11],['d',3]]
>>> add_occurence('a',ft)
[['a', 11], ['b', 5], ['c', 11], ['d', 3]]
>>> add_occurence('i',ft)
[['a', 11], ['b', 5], ['c', 11], ['d', 3], ['i', 1]]
不过这样的写法只适用於这一题哦!
※ 编辑: bigpigbigpig (111.243.149.233), 10/25/2014 12:04:02
※ 编辑: bigpigbigpig (111.243.149.233), 10/25/2014 12:06:16
2F:→ hohiyan: 谢谢,以後学到一些新function时我会注意的。 10/25 12:41
3F:→ YONIQ: 在这里有搜寻需要其实可以先把 ft 转成 dict 会比较好 10/25 12:48
如果可以不管 'a','b','c','d' 的顺序,dict() 确实比较方便。
def add_occurence(ch, ft):
D = dict(ft)
D[ch] = D.get(ch, 0) + 1
return [ [ k, v ] for k, v in D.items() ]
※ 编辑: bigpigbigpig (111.243.149.233), 10/25/2014 13:28:18
※ 编辑: bigpigbigpig (111.243.149.233), 10/25/2014 13:29:40