こんにちは、小澤です。
前回は、JavaScriptで動くページとSeleniumの基本について紹介しました。requestsとBeautifulSoupで取得したHTMLの中に目的の情報がない場合、ブラウザを自動操作して、画面に表示されたあとの要素を取得する方法がある、という内容でした。
ここまでの連載では、HTMLの構造を確認し、BeautifulSoupで必要な部分を取り出し、複数ページを巡回し、CSVやExcelに保存し、さらに定期実行やSeleniumの考え方まで見てきました。しかし、スクレイピングは、データを取得したところで終わりではありません。今回は、その次の段階として、取得したデータを分析や可視化につなげる方法を紹介します。分析といっても、いきなり難しい統計処理を行うわけではありません。まずは中身を確認し、空白や重複を整え、件数を数えるところから始めます。
この続きは以下をご覧ください
(リンク »)
お問い合わせにつきましては発表元企業までお願いいたします。

