logo_w
logo_w
  1. TOP
  2. メディア
  3. 画像解析ソフト
  4. 画像解析 学習データ

画像解析AI向け学習データの作り方 | データ収集とアノテーションの実務

画像解析AIの学習データ、どう作ればいいか分からず手が止まっていませんか?
結論から言うと、学習データ作成は「収集計画→アノテーションルール設計→作業実施→追加学習」の4ステップで進めれば、自社でも対応可能です。

外観検査のAI化を任されたものの、ベンダー見積もりは数百万円。「自社でできる範囲を把握したい」「まず何から始めればいいか知りたい」——そんな現場担当者に向けて、本記事では製造業の外観検査を例に、学習データ作成の実務手順を具体的に解説します。

この記事では、製造業の外観検査を例に、学習データの収集計画からアノテーションルールの設計、さらに運用後の追加学習まで、実務で必要な手順を具体的に解説します。

画像解析AIの学習データとは?製造現場で必要な基礎知識

画像解析AIを導入する前に、まず「学習データ」の基本を押さえておきましょう。ここでは、製造現場の担当者が最低限知っておくべき知識を3つのポイントに絞って解説します。

教師データ・アノテーションの役割を3分で理解する

教師データとは、AIに「これが正解」と教えるためのお手本となるデータのことです。外観検査の場合、「この画像は良品」「この画像はキズあり不良」といったラベル(正解情報)が付いた画像が教師データに該当します。

この「ラベルを付ける作業」をアノテーションと呼びます。アノテーションの精度がそのままAIの判定精度に直結するため、学習データ作成の中でも最も重要な工程です。

AIは、大量の教師データからパターンを学習し、「キズがある画像にはこういう特徴がある」と自ら判断基準を獲得していきます。つまり、教師データの質と量が、AIの性能を左右するのです。

外観検査AIに必要なデータ量の目安【100枚?1000枚?】

「結局、何枚のデータを用意すればいいのか?」——これは現場担当者が最も気になるポイントでしょう。

結論から言うと、外観検査AIの場合、最低でも各クラス(良品・不良品の種類ごと)100〜500枚が目安となります。ただし、これはあくまで「学習を開始できる最低ライン」であり、実運用で安定した精度を出すには1クラスあたり1,000枚以上が推奨されます。

なお、不良品は発生頻度が低いため、データ収集に時間がかかります。過去の検査記録や保管サンプルを活用するなど、効率的な収集方法を検討しましょう。

学習データの品質がAI精度の8割を決める理由

AI開発の世界には「Garbage In, Garbage Out(ゴミを入れればゴミが出る)」という格言があります。どれほど優れたAIモデルを使っても、学習データの品質が低ければ、出力される判定結果も低品質になるという意味です。

製造現場でよくある品質問題としては、以下のようなものがあります。

  • 撮影条件(照明・角度)がバラバラで、AIが製品の特徴ではなく「撮影環境の違い」を学習してしまう
  • アノテーションの判定基準が曖昧で、担当者によってラベルが異なる
  • 良品データばかりで不良品データが極端に少ない(クラス不均衡)

これらの問題を防ぐために、次章からは具体的なデータ収集計画の立て方を解説します。

【STEP1】学習データの収集計画を立てる

学習データの収集は、いきなりカメラで撮影を始めるのではなく、事前に計画を立てることが重要です。計画なしに進めると、「データは集まったが使えない」という事態に陥ります。

検査対象の「何を判定したいか」を明確にする

データ収集の第一歩は、「AIに何を判定させたいか」を明確に定義することです。

例えば「外観検査を自動化したい」という要望があった場合、以下のように具体化する必要があります。

  • 判定の種類: 良品/不良品の2分類なのか、不良の種類(キズ・汚れ・欠け・変形など)まで分類するのか
  • 検出の粒度: 製品全体の合否判定なのか、不良箇所の位置特定まで必要なのか
  • 許容範囲: どの程度の微細なキズまで不良とするのか

この定義が曖昧なまま進めると、後から「このデータでは判定できない」と手戻りが発生します。現場の検査員や品質管理部門と事前にすり合わせを行いましょう。

撮影条件を統一する(照明・角度・背景・解像度)

AIは画像のピクセル情報からパターンを学習します。そのため、撮影条件が統一されていないと、製品の特徴ではなく「撮影環境の違い」を学習してしまうリスクがあります。

統一すべき主な撮影条件は以下の通りです。

項目

推奨設定

照明

拡散光を使用し、影やハレーションを防ぐ。照度を一定に保つ

角度

カメラと製品の距離・角度を固定。治具を使用して位置決め

背景

単色(白・黒・グレー)の背景を使用。製品との明確なコントラストを確保

解像度

検出したい不良の最小サイズに応じて設定。一般的に500万画素以上を推奨

実際の製造ラインに設置するカメラと同等の条件で撮影することで、学習環境と運用環境のギャップを最小化できます。

良品/不良品のバリエーションを洗い出す【チェックリスト付き】

AIの汎化性能(未知のデータに対する対応力)を高めるには、実際に発生しうるバリエーションを網羅したデータを用意する必要があります。

以下のチェックリストを参考に、収集すべきデータのバリエーションを洗い出してください。

良品のバリエーション

  •  ロット違いによる微妙な色味・形状の差
  •  許容範囲内の寸法誤差
  •  製造時期による経年変化
  •  複数の製造ラインで生産されたもの

不良品のバリエーション

  •  不良の種類(キズ・汚れ・欠け・変形・異物混入など)
  •  不良の大きさ(微細〜大きなもの)
  •  不良の発生位置(中央・端・裏面など)
  •  不良の程度(軽微〜重度)

このリストをもとに、各パターンで最低50〜100枚のデータを収集することを目標にしましょう。

現場でよくある失敗:偏ったデータ収集で精度が出ない

データ収集でよくある失敗が「クラス不均衡」です。良品は大量に手に入るが、不良品は発生頻度が低いため、データ数に大きな偏りが生じます。

例えば、良品10,000枚に対して不良品100枚というデータセットで学習させると、AIは「とりあえず良品と判定しておけば99%正解する」と学習してしまいます。結果として、不良品を見逃す「見逃し不良」が多発します。

この問題への対処法としては、以下が有効です。

  • 不良品サンプルを意図的に作成する(破壊検査の活用)
  • 過去の不良品記録・画像を収集する
  • データ拡張(回転・反転・明度調整など)で不良品データを水増しする
  • 学習時にクラスの重み付けを調整する

【STEP2】アノテーションルールを設計する

データ収集と並行して、アノテーション(ラベル付け)のルールを設計します。ルールが曖昧だと、担当者によって判定がブレ、AIの学習精度が低下します。

本章では、次の内容を取り上げます。

  • アノテーションの種類と選び方(分類/物体検出/セグメンテーション)
  • 判定基準を「誰がやっても同じ結果」にするルール作り
  • アノテーションガイドラインのテンプレート
  • 現場でよくある失敗:担当者ごとに判定がブレる

それぞれ解説していきます。

アノテーションの種類と選び方(分類/物体検出/セグメンテーション)

アノテーションには複数の種類があり、「AIに何をさせたいか」によって選択する手法が異なります。

種類

概要

外観検査での用途例

作業コスト

画像分類

画像全体に1つのラベルを付与

製品全体の良品/不良品判定

物体検出

対象物を矩形(バウンディングボックス)で囲み、ラベルを付与

不良箇所の位置特定

セグメンテーション

対象物の輪郭をピクセル単位で指定

不良箇所の面積・形状の詳細分析

外観検査で「不良の有無だけ分かればよい」場合は画像分類、「どこに不良があるか示したい」場合は物体検出を選択するのが一般的です。セグメンテーションは精度が高い反面、アノテーション工数が大幅に増加するため、必要性を慎重に検討してください。

判定基準を「誰がやっても同じ結果」にするルール作り

アノテーションの品質を担保するには、「判定基準の明文化」が不可欠です。

例えば「キズがあれば不良」というルールだけでは、以下のような曖昧さが残ります。

  • 0.1mmのキズは不良か?
  • 許容範囲内の加工痕はキズに含めるか?
  • 光の反射で見えるキズ状の模様はどうするか?

これらを明確化するために、以下の項目を定義したガイドラインを作成しましょう。

  1. 不良の定義: 各不良タイプの具体的な条件(サイズ・深さ・位置など)
  2. 境界事例の判断基準: 判定が難しいケースの対処法と判定例
  3. バウンディングボックスの描き方: 余白の取り方、複数不良の扱い
  4. 判定に迷った場合のルール: 「迷ったら不良」など統一ルール

アノテーションガイドラインのテンプレート

以下は、外観検査用アノテーションガイドラインのテンプレート例です。自社の検査基準に合わせてカスタマイズしてご利用ください。

【アノテーションガイドライン】

■ 目的

本ガイドラインは、外観検査AI学習用データのアノテーション品質を統一することを目的とする。

■ クラス定義

クラス名 定義 判定基準
OK(良品) 出荷可能な製品 以下の不良条件に該当しないもの
NG_キズ 表面の線状の損傷 長さ0.5mm以上、または深さ0.1mm以上
NG_汚れ 異物の付着 直径0.3mm以上の付着物
NG_欠け 端部の欠損 0.2mm以上の欠損

■ バウンディングボックスの描き方

- 不良箇所を囲む最小の矩形を描く

- 不良箇所の外側に5〜10ピクセルの余白を設ける

- 複数の不良がある場合は、それぞれ個別にボックスを描く

■ 判断に迷った場合

- 不良か判断できない場合は「NG」として扱う(安全側に判定)

- 判断が難しい画像は「要確認」フォルダに分類し、責任者が判定

現場でよくある失敗:担当者ごとに判定がブレる

アノテーション作業を複数人で分担する場合、担当者間で判定基準のブレが生じやすくなります。

ある調査によると、複数のアノテーターが同じ画像にラベル付けした場合、一致率は平均で70〜80%程度にとどまるとされています。

この問題を防ぐために、以下の対策を講じましょう。

  • キャリブレーション: 作業開始前に全員で同じサンプル画像をアノテーションし、結果を突き合わせて認識を統一する
  • 定期的なすり合わせ: 週1回など定期的に判定結果をレビューし、基準のズレを修正する
  • ダブルチェック体制: 重要な画像は2人以上でアノテーションし、不一致があれば協議して決定する

【STEP3】アノテーション作業を実施する

ルールを設計したら、実際にアノテーション作業を進めます。

作業効率を上げるコツ:ショートカットとバッチ処理

アノテーション作業は、1枚あたり数十秒〜数分かかる地道な作業です。1,000枚のデータをアノテーションする場合、効率次第で総工数が大きく変わります。

作業効率を上げるためのコツを紹介します。

  • ショートカットキーを活用する
  • 同じクラスをまとめて処理する:「キズ」の画像を先にすべて処理し、次に「汚れ」を処理するなど、同じ判断を連続で行う
  • 自動アノテーション機能を活用する

品質チェックの方法:ダブルチェック体制の作り方

アノテーション品質を担保するには、作業後のチェック体制が重要です。以下のようなダブルチェック体制を構築しましょう。

レベル1: セルフチェック

  • 作業者自身が、作業完了後に全画像を見直す
  • 明らかなミス(ボックスのズレ、クラスの付け間違い)を修正

レベル2: クロスチェック

  • 別の作業者が、ランダムに10〜20%の画像を抽出してチェック
  • 不一致率が5%を超えた場合は、該当作業者の全データを再チェック

レベル3: 責任者レビュー

  • 境界事例や「要確認」フラグが付いた画像を責任者が最終判定
  • 判定結果をガイドラインにフィードバックし、ルールを更新

内製vs外注の判断基準【工数・コスト比較表付き】

アノテーション作業を自社で行うか、外部に委託するかは、データ量とコストのバランスで判断します。

工数の目安(物体検出の場合)

  • 熟練者: 1枚あたり30秒〜1分
  • 初心者: 1枚あたり2〜3分

1,000枚のアノテーションを行う場合、熟練者でも約8〜17時間、初心者では約33〜50時間かかります。

コスト比較表

項目

内製

外注

1枚あたりコスト

人件費換算で50〜150円

10〜50円(ボリュームディスカウントあり)

初期コスト

ツール導入・教育コスト

仕様説明・ガイドライン作成

品質管理

自社でコントロール可能

外注先の品質に依存

機密性

社外に出さないため安全

NDA締結・セキュリティ確認が必要

柔軟性

仕様変更に即対応可能

変更時に追加費用・工数が発生

判断の目安

  • 500枚以下: 内製がコスト効率良い
  • 500〜5,000枚: 内製と外注のハイブリッド(単純作業は外注、判断が難しいものは内製)
  • 5,000枚以上: 外注を中心に、品質チェックのみ内製

【STEP4】追加学習のタイミングと方法

AIを本番運用に投入した後も、継続的なメンテナンスが必要です。運用中に精度が低下した場合の対処法として、追加学習(継続学習)の手順を解説します。

本番運用後に精度が落ちる原因とは?

学習時には高い精度が出ていたのに、本番運用を始めたら精度が低下する——これは「データドリフト」と呼ばれる現象で、製造現場では珍しくありません。

主な原因としては以下が挙げられます。

  • 製品の変化: ロット違いによる色味・形状の微妙な変化、設計変更
  • 環境の変化: 照明の経年劣化、季節による光量変化、カメラレンズの汚れ
  • 新しい不良パターン: 学習時には存在しなかったタイプの不良の発生

追加学習が必要な3つのサイン

以下のサインが現れたら、追加学習を検討するタイミングです。これらのサインを早期に検出するために、運用ログの記録と定期的なレビューを仕組み化しておきましょう。

サイン1: 誤判定率の上昇

定期的に精度をモニタリングし、誤判定率が閾値(例: 5%)を超えたらアラートを出す仕組みを構築

サイン2: 検査員による手動修正の増加

AIの判定結果を検査員が頻繁に修正している場合、AIの判断基準と実際の基準にズレが生じている

サイン3: 新しいパターンの検出

これまで見たことのない不良パターンが発生した場合、既存モデルでは対応できない可能性が高い

追加データの収集と再学習の手順

追加学習を行う際の基本的な手順は以下の通りです。

手順1: 問題データの収集

  • 誤判定した画像を収集し、正しいラベルを付与
  • 新しい不良パターンがあれば、そのサンプルを重点的に収集

手順2: 既存データとの統合

  • 新しいデータのみで学習すると、過去のパターンを忘れる「破滅的忘却」が発生
  • 既存の学習データと新しいデータを混合して再学習を行う

手順3: 検証と本番適用

  • 新しいモデルを検証環境でテストし、精度が向上していることを確認
  • 本番環境への適用は段階的に行い、問題があればロールバックできる体制を整備

現場でよくある失敗:追加学習で過学習を起こす

追加学習でよくある失敗が「過学習(オーバーフィッティング)」です。これは、新しいデータに過剰に適応してしまい、汎用性が低下する現象です。

例えば、特定ロットで発生した不良データだけを大量に追加すると、そのロット特有のパターンに過剰適応し、他のロットの判定精度が低下する可能性があります。

過学習を防ぐためのポイントは以下の通りです。

  • 追加データの比率を制限する(全体の10〜20%程度に抑える)
  • バリエーションを意識して追加する(特定パターンに偏らない)
  • 検証データでの精度を常にチェックする
  • 定期的に学習データ全体を見直し、クレンジングを行う

学習データ作成を外注する場合の相場と選び方

すべてを内製するのが難しい場合、アノテーション作業の外注を検討しましょう。ここでは、外注の相場感と選定ポイントを解説します。

アノテーション外注の費用相場(1枚あたり○円〜)

アノテーション外注の費用は、作業の種類と複雑さによって大きく異なります。

作業種類

1枚あたり相場

備考

画像分類

5〜15円

1画像1ラベルの単純作業

物体検出(単一クラス)

15〜30円

1画像あたり1〜3個のボックス

物体検出(複数クラス)

30〜80円

複数種類の不良を識別

セグメンテーション

100〜300円

ピクセル単位の作業で高コスト

ボリュームディスカウントが適用されるケースが多く、10,000枚以上の大量発注では上記相場の50〜70%程度になることもあります。

また、初回は「トライアル発注」として少量(100〜500枚程度)を依頼し、品質を確認してから本発注に進むのがおすすめです。

外注先を選ぶ5つのチェックポイント

アノテーション外注先を選定する際は、以下の5つのポイントをチェックしましょう。

1. 品質管理体制

  • ダブルチェック・トリプルチェックの有無
  • 品質保証の内容(修正対応の範囲)

2. 専門性

  • 製造業の外観検査実績があるか
  • 類似案件の事例があるか

3. セキュリティ

  • ISMS認証やPマークの取得状況
  • データの保管・破棄ルール

4. コミュニケーション

  • 日本語での対応可否(海外BPOの場合)
  • 仕様変更時の対応スピード

5. スケーラビリティ

  • 大量発注への対応力
  • 納期の柔軟性

機密情報を扱う場合のセキュリティ確認事項

製造業の外観検査データには、製品形状や製造工程など機密性の高い情報が含まれることがあります。外注する場合は、以下のセキュリティ事項を必ず確認してください。

契約関連

  •  NDA(秘密保持契約)の締結
  •  データの目的外使用禁止条項
  •  再委託の可否と条件

技術的対策

  •  データ転送時の暗号化
  •  作業環境のアクセス制限
  •  作業端末からのデータ持ち出し禁止

運用面

  •  作業者の身元確認
  •  作業ログの記録
  •  契約終了後のデータ削除証明

特に、製品画像から競合他社に技術が漏洩するリスクがある場合は、国内拠点での作業を条件にするか、内製を選択することも検討しましょう。

この記事のまとめ

  • 画像解析AIの性能は、教師データとアノテーションの質に大きく左右されるため、まず「正解ラベルを揃えること」が最重要
  • データ量の目安は、最低でも各クラス100〜500枚、安定運用には1クラス1,000枚以上を目標にする
  • 収集は計画が先で、判定したい内容を具体化し、撮影条件を統一し、良品・不良品のバリエーションを網羅して集める
  • アノテーションは目的に合わせて手法(分類・検出・セグメンテーション)を選び、判定基準を文書化してブレをなくし、チェック体制で品質を担保する
  • 本番運用後は精度が落ちることがあるため、ログで兆候を検知し、既存データと混ぜて追加学習し、偏りによる過学習を避けながら改善を回す

画像解析ソフト関連製品・サービス

画像解析ソフト関連記事