Bilgisayarların görüntü ve videolardan anlamlı bilgi çıkarmasını sağlayan alan.
Bilgisayarlı görü (computer vision), bilgisayarların dijital görüntü ve videolardan anlamlı bilgi çıkarmasını, yorumlamasını ve bu bilgiye dayanarak kararlar almasını sağlayan yapay zeka alt alanıdır. Alan; bir görüntüyü belirli bir kategoriye atayan görüntü sınıflandırma, görüntü içindeki nesnelerin konumunu ve sınırlarını belirleyen nesne tespiti, her pikseli bir kategoriye atayan semantik bölütleme (segmentation), bir kişinin kimliğini görüntüden tanıyan yüz tanıma ve video karelerindeki hareketi analiz eden hareket tanıma gibi birçok alt görevi kapsar. Klasik yaklaşımlar kenar tespiti ve elle tasarlanmış özniteliklere dayanırken, 2012 yılından itibaren derin evrişimli sinir ağlarının (CNN) büyük görüntü veri kümelerinde çarpıcı başarılar göstermesiyle alan kökten değişmiştir.
Günümüzde bilgisayarlı görü sistemleri otonom araçlarda çevredeki nesneleri, yayaları ve trafik işaretlerini algılamak, tıbbi görüntülemede tümör ve anormallikleri tespit etmek, üretim hatlarında kalite kontrolü otomatikleştirmek, güvenlik sistemlerinde yüz ve hareket tanıma yapmak ve akıllı telefonlarda fotoğraf düzenleme ile artırılmış gerçeklik uygulamalarını mümkün kılmak gibi geniş bir uygulama yelpazesinde kullanılmaktadır. Son dönemde CNN'lerin yanı sıra, dikkat mekanizmasını görüntülere uygulayan Vision Transformer (ViT) mimarileri de birçok görevde rekabetçi hatta üstün sonuçlar vermeye başlamıştır.
ZncLabs temel özellikler için zorunlu çerezleri, isteğe bağlı analizleri ise yalnızca onayınızla kullanır. Ayrıntılar için Gizlilik sayfasını inceleyin.