答えを探そう
Coddyの「pandasによるデータ分析」コースのレッスン 18/19。
チャレンジ
中級CSVファイル answers.csv にはランダムな回答が含まれています。このチャレンジでは、詳細な分析を行います。
以下は、ファイルの最初の5行です:
answer_id,value
1,"She learned that water bottles are no longer just to hold liquid, but they're also status symbols."
2,"When she didn’t like a guy who was trying to pick her up, she started using sign language."
3,"Eating eggs on Thursday for choir practice was recommended."
4,"He dreamed of leaving his law firm to open a portable dog wash."
num_wordsという名前の列を作成し、各回答に何単語含まれているかを計算してください。num_exclamationという名前の列を作成し、各回答に感嘆符(!)がいくつ含まれているかを計算してください。num_questionという名前の列を作成し、各回答に疑問符(?)がいくつ含まれているかを計算してください。num_dotという名前の列を作成し、各回答にドット(.)がいくつ含まれているかを計算してください。num_symbolsという名前の列を作成し、num_exclamation、num_question、num_dotを合計してください。upper_charsという名前の列を作成し、回答の中に大文字がいくつ含まれているかを計算してください。
疑問符とドットは特殊文字です。これらを扱う際は、文字列の前に "\" と
<strong>r</strong>(raw) を追加してください:r"\?", r"\."
結果を df に保存してください。
自分で試してみよう
# pandas は pd として既にインポートされています
df = pd.read_csv("./answers.csv")
# 以下にコードを書いてください
pandasによるデータ分析のすべてのレッスン
自分で練習してみよう: Pythonオンラインコンパイラ