ما هو الرؤية الحاسوبية
ذكاء اصطناعي لتحليل الصور والفيديو
الرؤية الحاسوبية — مجال في الذكاء الاصطناعي يدرب الحواسيب على استخراج المعلومات من الصور والفيديو.
المهام الرئيسية
- تصنيف الصور — تحديد الكائنات في الصور
- كشف الكائنات — إيجاد وتحديد الكائنات بصناديق الإحاطة
- التجزئة — تسمية الصور على مستوى البكسل
- التعرف على الوجوه — تحديد والتحقق من الأشخاص
- OCR — التعرف على النص في الصور
- تتبع الكائنات — التتبع في تدفقات الفيديو
التقنيات الرئيسية
- CNN (الشبكات الالتفافية) — أساس CV الحديث
- YOLO — كشف الكائنات في الوقت الحقيقي
- ResNet وEfficientNet — معماريات التصنيف
- U-Net وMask R-CNN — التجزئة الدلالية
- Vision Transformers — المحولات للصور
التطبيقات التجارية
- مراقبة الجودة — كشف العيوب التلقائي في التصنيع
- التجزئة — التعرف على المنتجات ومراقبة الرفوف وتحليل الطوابير
- الأمن — المراقبة بالفيديو مع التعرف على الوجوه والأفعال
- الرعاية الصحية — تحليل الأشعة السينية والرنين المغناطيسي والأشعة المقطعية للتشخيص
- السيارات — القيادة الذاتية وأنظمة ADAS