データを「AIレディ」にするための3つのステップ

 Everpureでは、AIのためにデータを準備するプロセスを3つのステップで整理している。第1が「見える化」、第2が「分類・文脈化」、第3がAIに入力するための「整理・整形」だ。この3段階を経てデータを「AIレディ」の状態にすることが、AIの力を本当に引き出すための前提になる。

[画像のクリックで拡大表示]

 第1のステップである「見える化」から見ていこう。企業のデータは、クラウドや部門ごとのファイルサーバー、基幹データベース、各種業務アプリケーションなど、様々な場所に分散している。本社や子会社だけでなく、支店、工場、海外拠点にも広がっているのが一般的だ。

 その種類やファイル形態も多岐にわたる。顧客情報や店舗情報、売上情報、利用統計といった構造化データのほか、製造業であれば製造マニュアルや製造工程の品質記録、さらにはPDF、Officeファイル、画像、ログ、センサーデータなど、形式の異なる非構造化データも大量に存在する。

 こうしたデータを棚卸ししないまま収集してAIに入力すれば、ハルシネーションを招くだけでなく、外部に開示してはならない情報が紛れ込む危険もある。だからこそ、まず全社でデータを棚卸しし、どこにどのようなデータがあるのかを横断的に把握する必要がある。それが「見える化」である。