6
Python、文字列からすべての非アルファベット文字を削除します
私はPythonMapReduceワードカウントプログラムを書いています。問題は、データにアルファベット以外の文字がたくさん散らばっているということです。この投稿を見つけました。Pythonの文字列から英数字以外の文字をすべて削除します。これは、正規表現を使用した優れたソリューションを示していますが、実装方法がわかりません。 def mapfn(k, v): print v import re, string pattern = re.compile('[\W_]+') v = pattern.match(v) print v for w in v.split(): yield w, 1 ライブラリの使用方法reや、そのことについての正規表現すらわからないのではないかと思います。着信文字列(本の行)に正規表現パターンをv適切に適用して、英数字以外の文字を含まない改行を取得する方法がわかりません。 提案?