二維碼
        企資網

        掃一掃關注

        當前位置: 首頁 » 企業資訊 » 熱點 » 正文

        盤點一個英文文本中統計關鍵詞的方法

        放大字體  縮小字體 發布日期:2022-12-07 18:08:24    作者:微生翼虎    瀏覽次數:50
        導讀

        大家好,我是皮皮。一、前言前幾天在Python最強王者交流群【Wendy Zheng】問了一個英文文本中統計關鍵詞得問題,這里拿出來給大家分享下。二、實現過程針對這個問題,感謝給出一個思路方法,也許有幫助,首先我們需

        大家好,我是皮皮。

        一、前言

        前幾天在Python最強王者交流群【Wendy Zheng】問了一個英文文本中統計關鍵詞得問題,這里拿出來給大家分享下。

        二、實現過程

        針對這個問題,感謝給出一個思路方法,也許有幫助,首先我們需要將Excel中得文本進行導入到一個文感謝件中去,代碼如下:

        # coding: utf-8import pandas as pddf = pd.read_excel('./文本.xlsx')# print(df.head())# df['可以關鍵詞']for text in df['工作要求']: # print(text) if text is not None: with open('工作要求.txt', mode='a', encoding='utf-8') as file: file.write(str(text))print('寫入完成')

        接下來就可以針對這個文感謝件進行相關得詞頻統計了,如果你有自己自定義得關鍵詞,也可以就著關鍵詞去統計,沒有得話,就自己在關鍵詞范圍內,任意取多少個關鍵詞都可以,相關得代碼如下所示:

        from collections import Counterimport pandas as pddf = pd.read_excel('./文本.xlsx')# print(df.head())words = []with open('工作要求.txt', 'r', encoding='utf-8') as f: line = f.readlines() for word in line[0].split(' '): words.append(word)print(len(words))counter = Counter(words)# print(counter)# df['可以關鍵詞']for text in df['可以關鍵詞']: for k, v in counter.items(): if k == text: print(k, v)

        這個代碼對于英文文本還是適用得,不過有個小問題,如下。

        最后這里也給出中文分詞得代碼和可視化代碼,兩者結合在一起得,感興趣得小伙伴們可以試試看。

        from collections import Counter # 統計詞頻from pyecharts.charts import Barfrom pyecharts import options as optsfrom snownlp import SnowNLPimport jieba # 分詞with open('text_分詞后_outputs.txt', 'r',encoding='utf-8') as f: read = f.read()with open('stop_word.txt', 'r', encoding='utf-8') as f: stop_word = f.read()word = jieba.cut(read)words = []for i in list(word): if i not in stop_word: words.append(i)columns = []data = []for k, v in dict(Counter(words).most_common(10)).items(): columns.append(k) data.append(v)bar = ( Bar() .add_xaxis(columns) .add_yaxis("詞頻", data) .set_global_opts(title_opts=opts.TitleOpts(title="詞頻top10")) )bar.render("詞頻.html")三、總結

        大家好,我是皮皮。這篇文章主要盤點了一個英文文本中統計關鍵詞方法處理得問題,文中針對該問題,給出了具體得解析和代碼實現,幫助粉絲順利解決了問題。

        最后感謝粉絲【Wendy Zheng】提問,感謝【Python進階者】給出得思路和代碼解析,感謝【Python狗】等人參與學習交流。

         
        (文/微生翼虎)
        免責聲明
        本文僅代表作發布者:微生翼虎個人觀點,本站未對其內容進行核實,請讀者僅做參考,如若文中涉及有違公德、觸犯法律的內容,一經發現,立即刪除,需自行承擔相應責任。涉及到版權或其他問題,請及時聯系我們刪除處理郵件:weilaitui@qq.com。
         

        Copyright ? 2016 - 2025 - 企資網 48903.COM All Rights Reserved 粵公網安備 44030702000589號

        粵ICP備16078936號

        微信

        關注
        微信

        微信二維碼

        WAP二維碼

        客服

        聯系
        客服

        聯系客服:

        在線QQ: 303377504

        客服電話: 020-82301567

        E_mail郵箱: weilaitui@qq.com

        微信公眾號: weishitui

        客服001 客服002 客服003

        工作時間:

        周一至周五: 09:00 - 18:00

        反饋

        用戶
        反饋

        蜜臀AV无码国产精品色午夜麻豆| 中文无码精品一区二区三区| 久久中文字幕人妻熟av女| 亚洲欧美日韩在线中文字幕 | 中文字幕无码久久精品青草| 亚洲AV无码精品色午夜果冻不卡 | 久久久久久久久久久久中文字幕 | 亚洲欧美中文日韩V在线观看| 久久国产亚洲精品无码| 国产一区二区中文字幕| 无码人妻精品一区二区三| 亚洲无av在线中文字幕| 西西午夜无码大胆啪啪国模| 最新中文字幕AV无码不卡| 亚洲AV无码一区二区二三区入口| 日韩亚洲欧美中文在线| 无码毛片视频一区二区本码| 无码AV中文一区二区三区| 日韩人妻无码精品一专区| 久久久久久无码国产精品中文字幕| 国产精品无码专区| 天堂Aⅴ无码一区二区三区 | 亚洲VA中文字幕不卡无码| 人妻中文字幕乱人伦在线| 精品无码久久久久国产| 久久精品中文无码资源站| 久クク成人精品中文字幕| 久久无码人妻一区二区三区午夜 | √天堂中文www官网| 88国产精品无码一区二区三区| 中文字幕无码高清晰 | 亚洲日韩欧洲无码av夜夜摸| 亚洲av中文无码乱人伦在线r▽| 人妻中文字幕无码专区| 三上悠亚ssⅰn939无码播放| 亚洲中文字幕无码中文字在线| 精品日韩亚洲AV无码| 亚洲精品无码mv在线观看网站| 我的小后妈中文翻译| 日韩精品无码一区二区中文字幕| 毛片一区二区三区无码|