Was ist Computer Vision
KI für Bild- und Videoanalyse
Computer Vision — ein Bereich der künstlichen Intelligenz, der Computer trainiert, Informationen aus Bildern und Videos zu extrahieren.
Hauptaufgaben
- Bildklassifizierung — Objekterkennung in Fotos
- Objekterkennung — Finden und Lokalisieren von Objekten mit Bounding Boxes
- Segmentierung — pixelweise Bildmarkierung
- Gesichtserkennung — Identifikation und Verifizierung von Personen
- OCR — Texterkennung in Bildern
- Objektverfolgung — Tracking in Videoströmen
Schlüsseltechnologien
- CNN (Faltungsnetzwerke) — Grundlage des modernen CV
- YOLO — Echtzeit-Objekterkennung
- ResNet, EfficientNet — Klassifizierungsarchitekturen
- U-Net, Mask R-CNN — semantische Segmentierung
- Vision Transformers (ViT) — Transformer für Bilder
Geschäftsanwendungen
- Qualitätskontrolle — automatische Fehlererkennung in der Fertigung
- Einzelhandel — Produkterkennung, Regalüberwachung, Warteschlangenanalyse
- Sicherheit — Videoüberwachung mit Gesichts- und Aktionserkennung
- Gesundheitswesen — Röntgen-, MRT-, CT-Analyse für Diagnostik
- Automobil — Autopilot und ADAS-Systeme