コンピュータビジョン とは
画像とビデオ分析のためのAI
コンピュータビジョン — 画像や動画から情報を抽出するようコンピュータを訓練する人工知能の分野。
主なタスク
- 画像分類 — 写真内のオブジェクト識別
- 物体検出 — バウンディングボックスでオブジェクトを検索・特定
- セグメンテーション — ピクセル単位の画像ラベリング
- 顔認識 — 人物の識別と検証
- OCR — 画像内のテキスト認識
- 物体追跡 — 動画ストリームでのトラッキング
主要技術
- CNN(畳み込みネットワーク) — 現代CVの基盤
- YOLO — リアルタイム物体検出
- ResNet、EfficientNet — 分類アーキテクチャ
- U-Net、Mask R-CNN — セマンティックセグメンテーション
- Vision Transformers (ViT) — 画像用トランスフォーマー
ビジネス活用
- 品質管理 — 製造での自動欠陥検出
- 小売 — 商品認識、棚監視、行列分析
- セキュリティ — 顔・行動認識付きビデオ監視
- 医療 — 診断のためのX線、MRI、CT分析
- 自動車 — オートパイロットとADASシステム