2017年に入って行われたMicrosoft Researchのプレゼンテーションによれば、データサイエンティストは作業時間の80%をデータの抽出とクリーニングに費やしているという。この作業は「データラングリング」とも呼ばれる。Microsoftはこの状況を改善したいと考えている。 それが「Project Pendleton」だ。 筆者は1年前、情報提供者の1人から、Microsoftが「Pendleton」というコードネームで、機械学習関連の新しいツールに取り組んでいるという話を耳にした。しかし、このツールについて記事にできるだけの情報は、The Walking Cat氏(Twitterアカウント:@h0x0d on Twitter)が情報や資料を明るみに出すまで手に入れることができずにいた。 The Walking Cat氏が提供したPendletonの資料の導入部分で、Microso
