文章詳情頁

python - 如何正則字符串中的所有漢字

瀏覽：214日期：2022-06-28 10:06:59

問題描述

這樣算嗎？121238asdf<img src='https://imgsa.baidu.com/forum/w%3D580/sign=da0493cd90ef76c6d0d2fb23ad14fdf6/e483aa4bd11373f0bddb2e73a40f4bfbf9ed04b1.jpg' height='420'>

字符串如上，類型是’str’，要正則獲得漢字。我之前使用[u4e00-u9fa5]結果獲得的還是英文，符號跟數(shù)字的list。求教導正確姿勢。另外說說我哪里寫錯了..

pattern = re.compile(r’[u4E00-u9FA5]’)print pattern.findall(x[1])

這是我寫的...但是返回結果就沒有漢字，反而是除漢字外的其他字符。

問題解答

回答1：

我這里假設你需要匹配的文本為s：

pattern = re.compile(ur'[u4e00-u9fa5]')print pattern.findall(s.decode(’utf8’))

這里的decode(’utf8’)是怕s的值為類似x66x77x88這樣的Unicode散列。另外，需要注意compile()中ur修飾符，u為Unicode修飾符。

PS：我是從這篇文章得到的啟發(fā)。

Update

剛才看了下樓下說的，確實用Python 3就不存在輸出為Unicode散列的情況了，以下摘自此處

Unicode 字符串

在Python2中，普通字符串是以8位ASCII碼進行存儲的，而Unicode字符串則存儲為16位unicode字符串，這樣能夠表示更多的字符集。使用的語法是在字符串前面加上前綴 u。

在Python3中，所有的字符串都是Unicode字符串。

回答2：

你用的是python2，uxxxx是unicode字符，匹配后得到的是字節(jié)串，print出來是各個字節(jié)值。

換python3 就沒這個問題了

Python 編程

上一條：python - Django ModelSerializer 如何POST提交非Models中定義、關聯(lián)表中的字段？下一條：python - 網(wǎng)頁title中包含換行，如何用正則表達式提取出來？

相關文章：

1. javascript - sublime快鍵鍵問題2. javascript - immutable配合react提升性能？3. css - 寫頁面遇到個布局問題，求大佬們幫解答，在線等，急！~4. javascript - nodejs關于進程間發(fā)送句柄的一點疑問5. Apache 已經(jīng)把網(wǎng)站根目錄的改為allow from all了，但是服務器還是不能訪問？6. 實現(xiàn)bing搜索工具urlAPI提交7. 配置Apache時，添加對PHP的支持時語法錯誤8. vue.js - Vue 如何像Angular.js watch 一樣監(jiān)聽數(shù)據(jù)變化9. javascript - 移動端上不能實現(xiàn)拖拽布局嗎？10. phpstudy8.1支持win11系統(tǒng)嗎？

排行榜

					
					javascript - sublime快鍵鍵問題
javascript - immutable配合react提升性能？
vue.js - Vue 如何像Angular.js watch 一樣監(jiān)聽數(shù)據(jù)變化
javascript - nodejs關于進程間發(fā)送句柄的一點疑問
css - 寫頁面遇到個布局問題，求大佬們幫解答，在線等，急！~
javascript - 移動端上不能實現(xiàn)拖拽布局嗎？
配置Apache時，添加對PHP的支持時語法錯誤
實現(xiàn)bing搜索工具urlAPI提交
Apache  已經(jīng)把網(wǎng)站根目錄的改為allow from all了，但是服務器還是不能訪問？
phpstudy8.1支持win11系統(tǒng)嗎？
如何解決Centos下Docker服務啟動無響應，且輸入docker命令無響應？
				

熱門標簽

日本不卡不码高清免费观看,久久国产精品久久w女人spa,黄色aa久久,三上悠亚国产精品一区二区三区

python - 如何正則字符串中的所有漢字