|
|
背景:python初学者。
最近用python写了一个文本分析的小程序,主要是去除重复后用jieba来分词。可能因为算法问题,比较慢,处理1个5M的文件需要60s,后面听说pypy会快一些,就试了下,结果更慢了,需要240s,这也太离谱了吧。
目测在执行这个函数时花费时间极多:
def sortlist(list0,num): listTemp=[] for i in list0: if not i in listTemp and len(i[4])>num: #len(i[4])>num 是为了筛选参与人数超过18人的对话,个人特殊用途 listTemp.append(i) return listTemp
有大神能分析下吗? |
|