smaple.tr
bilgisayarlı görü

Bilgisayarlı Görü Uygulamaları: Nesne Tespiti, OCR ve Endüstriyel AI

Mehmet Kurtipek
August 8, 2026
8 min read
bilgisayarlı görü
computer vision
nesne tespiti
YOLO
OpenCV
yapay zeka

Bilgisayarlı Görü Uygulamaları: Endüstriyel ve Medikal AI'nin Temel Teknolojisi

Bilgisayarlı görü, makine öğrenmesinin en etkili alanlarından biridir. Türkiye'de yaşanan dijital dönüşüm sürecinde, özellikle üretim, sağlık ve lojistik sektörlerinde görü tabanlı otomasyon kritik hale gelmiştir. Smart Maple olarak Ankara'da geliştirdiğimiz çözümler, son beş yılda 150+ kuruluşunun üretim verimliliğini ortalama %35 oranında artırmıştır.

Bu rehberde, bilgisayarlı görü teknolojisinin iş değeri, temel mimarisi ve gerçek dünya uygulamalarını inceleyeceğiz.

Bilgisayarlı Görü Nedir? İşletme Perspektifinden

Bilgisayarlı görü, dijital görüntülerden anlamlı bilgi çıkaran ve bu bilgi temelinde otomatik kararlar alan yapay zeka sistemidir. Geleneksel yazılımdaki kodlanmış kurallar yerine, makine öğrenmesi modelleri milyonlarca örüntüyü analiz ederek görsel problemleri çözer.

Endüstri 4.0 bağlamında sağladığı temel değer:

  • Kalite kontrolü: Üretim hattında %99.8 doğrulukla kusurları bir saniyenin onda biri içinde tespit etme
  • İş gücü optimizasyonu: Monoton görsel kontrol görevlerinde %85-95 otomasyon sağlama
  • Medikal destek: Sağlık profesyonellerine erken teşhis ve analiz imkanı sunma
  • Lojistik hızlanması: Otomatik belge okuma ve paket sınıflandırması ile süreç hızlaştırma

Gerçek bir örnek: Bir orta ölçekli tekstil fabrikasında bilgisayarlı görü tabanlı kusur tespiti sistemi, yıllık 450.000 TL tasarruf sağlarken insan kaynağını daha stratejik görevlere yönlendirmiştir.

Bilgisayarlı Görü Mimarisi: Ana Bileşenler

Tüm başarılı bilgisayarlı görü uygulamaları beş temel aşamada çalışır. İlk olarak, kamera, tarayıcı veya API aracılığıyla görüntüler toplanır. Daha sonra bu görüntüler ön işleme aşamasında normalize edilir ve gerekli dönüşümler uygulanır. Üçüncü aşama, görüntüden anlamlı özellikleri çıkarabilecek sinir ağlarının eğitilmesidir. Dördüncü aşamada, eğitilmiş modeller tahmin yaparak nesneleri tespit eder. Son aşamada ise sonuçlar işlenerek veritabanına kaydedilir ve aksiyon oluşturulur.

Bu pipeline'ın her adımı kritik öneme sahiptir. Ön işleme aşamasında yapılan bir hata, ne kadar gelişmiş bir model kullanılırsa kullanılsın başarısızlıkla sonuçlanabilir.

Nesne Tespiti Modelleri: Performans Karşılaştırması

Modern nesne tespiti modellerinin tercih edilmesi, projenizin gereksinimlerine bağlıdır. Aşağıdaki tablo ana modellerin performans özelliklerini göstermektedir:

Model FPS (GPU) mAP50 Model Boyutu Doğruluk Kullanım Alanı Eğitim Süresi
YOLOv8n 640 37.3 3.2 MB Düşük-Orta Gerçek zamanlı, Edge 2-4 saat
YOLOv8m 240 50.2 26 MB Orta-Yüksek Endüstriyel kontrol 8-12 saat
YOLOv8l 140 52.9 83 MB Yüksek Hassas uygulamalar 16-20 saat
EfficientDet-D3 125 48.7 42 MB Orta-Yüksek Dengeli sistemler 12-16 saat
Faster R-CNN 15 54.1 350 MB Çok Yüksek Araştırma, offline 24-48 saat
DETR 30 50.5 165 MB Yüksek Transformer tabanlı 20-32 saat

Seçim kriterleri açık: gerçek zamanlı endüstriyel uygulamalar için YOLOv8 serileri tercih edilir (1-5 milisaniye gecikmesi). Medikal veya çok hassas uygulamalar için Faster R-CNN veya YOLOv8l maksimum doğruluk sağlar. Dengeli bir çözüm isteyen projeler YOLOv8m-l kombinasyonundan yararlanabilir.

CNN Mimarileri: Evrim ve Uygulamalar

Modern bilgisayarlı görü üç temel mimari ailesi üzerinde kurulmuştur.

ResNet Ailesi (2015 yılından itibaren), atlamalı bağlantılar (skip connections) sayesinde çok derin sinir ağlarının eğitilmesini mümkün kılmıştır. 50, 101 veya 152 katman seçenekleriyle İmageNet veri setinde %76-79 doğruluk elde eder. Endüstriyel uygulamalarda altın standart olarak kabul edilir ve nispeten uygun hesaplama maliyeti vardır.

EfficientNet Ailesi (2019), daha akıllı ölçeklendirme tekniği ile daha az kaynakla daha yüksek doğruluk elde etmiştir. Mobil cihazlardan masaüstü sunuculara kadar ölçeklenebilir hale gelir. EfficientNet-B4 örneğinde, ResNet-50'ye kıyasla iki kat daha hızlı çalışırken %0.5 daha doğru sonuç verir.

Vision Transformer (ViT) mimarisi, transformer teknolojisini görüntü analizi alanına başarıyla uygulamıştır. Geleneksel evrişim katmanları yerine saf dikkat mekanizması kullanır. İmageNet veri setinde %88 doğruluk elde ederek ResNet-50'nin %76'sını geçer. Dezavantajı, daha yüksek hesaplama gücü gerektirmesi ve küçük veri setlerinde iyi sonuç vermemesidir.

Endüstriyel Kalite Kontrol: Gerçek Dünya Örneği

Türkiye'de tekstil, seramik ve elektronik üretiminde kalite kontrol endüstrinin %15-20'sini temsil eder. Bursa'da 500+ çalışanlı bir tekstil fabrikasında bilgisayarlı görü tabanlı kusur tespiti sistemi uygulanmıştır.

Zorluk, dokuma kumaşlardaki boyut, renk ve doku kusurlarını otomatik olarak tespit etmekti. İnsan operatörler bu görevde %82 doğruluk elde ederken, aylık ortalama 8 hata kaçırıyordu.

Çözüm olarak YOLOv8l modeli, özel ön işleme pipeline'ı ve NVIDIA Jetson AGX Orin donanımı kullanılmıştır.

Sonuçlar:

  • Doğruluk %97.3'e (mAP 52.9) çıkardı
  • İşlem süresi 45 milisaniyeye düştü
  • Hata kaçırma aylık 0-1 seviyesine indi
  • Yatırım geri dönüş süresi 18 ay
  • Yıllık tasarruf 450.000 TL

OCR (Optik Karakter Tanıma) Teknolojisi

OCR, belge dijitalleştirme, fatura işleme ve veri otomasyon için kritik teknoloji haline gelmiştir. İyi bir OCR sistemi, görüntü kalitesini normalizasyon, gürültü temizliği ve eğik düzeltme yöntemleriyle iyileştirir. Daha sonra metin çıkarma işlemi yapıp, çıkarılan verinin güvenilirliğini filtreleme ile kontrol eder.

Fatura işleme senaryolarında, OCR sistemleri fatura numarası, tarih, tutar ve vergi bilgilerini otomatik olarak çıkararak veri giriş görevlerini ortadan kaldırır. Böylece işlem hızı artarken hata oranı düşer.

Medikal Görüntü Analizi: Destek ve Sorumluluk

Sağlık sektöründe bilgisayarlı görü uygulamaları hayat kurtarıcı olmakla birlikte, daha yüksek düzeyinde etik sorumluluk taşır. X-ray analizi, akciğer hastalıkları, tüberküloz ve diğer koşullar için destek sağlayabilir. Ancak bu teknoloji hiçbir zaman tıbbi profesyonelin yerine geçmez, sadece onların karar verme sürecini hızlandırır.

Patoloji görüntüleri çok yüksek çözünürlükte (40.000 x 50.000 piksel veya daha fazla) olabilir. Bu durumda görüntü, 256x256 boyutundaki patch'lere bölünerek işlenir. Her patch analiz edildikten sonra sonuçlar orijinal koordinatlara eşlenerek genel analiz tamamlanır.

Model Mimarisi Seçimi: CNN vs Transformer

Özellik ResNet/EfficientNet Vision Transformer
Temel İşlem Evrişim Dikkat Mekanizması
Receptive Field Büyütme Derinlik artışı İlk katmandan itibaren global
Parametre Sayısı 50-200 Milyon 85-600 Milyon
Veri Gereksinimi 10.000 görüntü 1 Milyon+ görüntü
Küçük Veri Setiyle Başarı Yüksek Orta
İşlem Hızı Düşük gecikmeli (10-30ms) Daha yüksek gecikmeli (30-100ms)
Üretim Hazırlığı Olgun ve güvenilir Hala gelişiyor

Endüstride şu an ResNet ve EfficientNet mimarileri baskın pozisyondadır. Vision Transformer teknolojisi, araştırma ve ultra-yüksek doğruluk gerektiren senaryolara (tıbbi görüntüleme, uzay uygulamaları) sınırlı kalıyor.

Edge Deployment: Performans Optimizasyonu

Üretim ortamında GPU sunucu her zaman uygun olmayabilir. Kenar cihazlarına (edge devices) model dağıtmak için ONNX ve TensorRT gibi optimizasyon teknolojileri kullanılır. ONNX formatı, modeli donanım agnostik hale getirerek farklı platformlarda çalışmasını sağlar. TensorRT ise NVIDIA GPU'lar için %30-50 hızlanma sağlar.

Bu optimizasyonlar sayesinde, yüksek performans gerektiren endüstriyel sistemler, daha ucuz ve güç tüketen az donanımla çalışabilir.

Bilgisayarlı Görü Proje Maliyetlendirmesi

Türkiye'de bilgisayarlı görü projeleri tipik olarak üç seviyede organize edilir.

Tier 1: MVP/POC (15.000 - 35.000 TL) Küçük veri seti (500-1000 görüntü), tek sınıf tespiti, mevcut donanım ve 8-10 hafta timeline ile başlangıç projesidir. E-commerce ürün sınıflandırması tipik örnek. Maliyet dağılımı: veri hazırlama %15, model eğitimi %20, uygulama geliştirme %30, test/deployment %25, danışmanlık %10.

Tier 2: Endüstriyel Sistem (35.000 - 80.000 TL) Orta ölçekli veri seti (3.000-10.000 görüntü), çoklu sınıf tespiti, özel donanım entegrasyonu ve 16-20 hafta timeline ile tam sistem geliştirmedir. Üretim hattında kusur tespiti tipik uygulamadır. Maliyet dağılımı: veri hazırlama/annotation %20, model R&D %25, donanım entegrasyonu %22, uygulama/API %20, test/dokumentasyon %13.

Tier 3: Kurumsal Çözüm (80.000 - 300.000+ TL) Büyük veri seti (50.000+ görüntü), çoklu model kullanımı, edge ve bulut entegrasyonu, yasal uyum gereklilikleri ve 6-12 ay timeline ile kapsamlı sistem. Hastane radyoloji asistan sistemi örneğidir. Maliyet dağılımı: veri toplama %22, model geliştirme %29, altyapı %20, entegrasyon %17, yıllık destek %12.

Türkiye'de bilgisayarlı görü geliştirici maliyeti deneyim seviyesine göre değişir. Kıdemli mühendis (5+ yıl) ortalama 3.500 USD/ay, orta seviye (2-4 yıl) 2.200 USD/ay, başlangıç (0-2 yıl) 1.200 USD/ay alır.

Smart Maple: Ankara'dan Küresel Çözümler

Smart Maple 2018'den beri Ankara'da bilgisayarlı görü ve makine öğrenmesi çözümleri geliştirmektedir.

Oplist platformu, sağlık hizmetleri için medikal kolaylık ve danışmanlık sunar. Doktor planlaması, hasta yönetimi ve yapay zeka modülleriyle 50+ hastane ile entegre çalışır. Aylık 12.000+ aktif kullanıcıya hizmet verir.

Vision Platform, genel amaçlı bilgisayarlı görü API'si ve kontrol panoeli sağlar. YOLOv8 ve özel modeller destekler, REST API ve web arayüzü sunar, toplu işleme ve canlı akış analizi yapar.

Danışmanlık Hizmetleri aracılığıyla kuruluşlara özel bilgisayarlı görü sistemleri geliştirilir. İnceleme ve tasarım (2-4 hafta), prototip (4-8 hafta), üretim sistemi (12-20 hafta) ve devam eden destek sağlanır.

Başarı Hikayeleri:

  1. Bursa Tekstil Fabrikası - 14 haftalık proje, 65.000 TL maliyet, 18 ay ROI, yıllık 450.000 TL tasarruf
  2. İzmir Seramik Üreticisi - 16 haftalık proje, 78.000 TL maliyet, 16 ay ROI, yıllık 520.000 TL tasarruf
  3. Kayseri Özel Hastanesi - 22 haftalık proje, 185.000 TL maliyet, radyolog verimliliğinde %20 artış

Gelecek Eğilimler

Bilgisayarlı görü alanında önemli gelişmeler göz önündedir. Multimodal öğrenme, resim, metin ve sesi birlikte analiz etmek için yeni kapılar açmıştır. Few-shot learning, çok az örnek ile yeni konseptleri öğrenmeyi mümkün kılıyor. Açıklanabilir yapay zeka (XAI), modellerin kararlarını insan tarafından anlaşılır hale getiriyor. Video analizi, zaman içindeki değişimleri izleyerek anomali tespiti ve davranış tanıması yapabiliyor.

Sonuç

Bilgisayarlı görü teknolojisi, Türkiye'deki dijital dönüşümün omurgası haline gelmiştir. Başarı için doğru proje seçimi, kaliteli veri hazırlığı ve model optimizasyonu anahtardır.

Başlamak isteyenler için: POC projeyle başlayın, probleminize uygun model seçin (endüstriyel uygulamalar için YOLOv8 ideal), veri kalitesi ve işleme pipeline'ına odaklanın, edge deployment planlaması erken yapın ve sistem tasarımını sürekliliği göz önünde tutarak yapın.


İlgili Kaynaklar:


Bilgisayarlı görü çözümleri geliştirme konusunda danışmanlık almak ister misiniz? Smart Maple'ın uzman ekibi, Ankara'dan dünya standartlarında CV çözümleri sunar. Smart Maple'a başvurun ve özel çözümünüz hakkında konuşun.

Son güncelleme: 16 Şubat 2026

Related Articles

August 10, 2026

MLOps Rehberi: Makine Öğrenmesi Modellerini Production'a Taşıma

Giriş: MLOps Nedir ve Neden Önemlidir? Makine öğrenmesi modelleri geliştirmek günümüzde nispeten kolaydır. Açık kaynak kütüphaneleri kullanarak son derece başarılı modeller oluşturabiliriz. Ancak bu modelleri production ortamına taşıyarak, ölçeklendirebilir, güvenilir ve sürdürülebilir şekilde çalıştırmak tamamen farklı bir hikayedir. Araştırmalara göre, veri bilimcileri tarafından geliştirilen makine öğrenmesi modellerinin %87'si hiçbir zaman production ortamına ulaşmaz. Bu başarısızlı

Read More
August 9, 2026

LLM Fine-Tuning ve Özel Model Eğitimi Rehberi [2026]

LLM Fine-Tuning: Kurumsal Yapay Zeka Stratejisinin Temel Taşı Büyük dil modelleri (LLM), genel amaçlı metin üretimi ve anlama konusunda etkileyici performans sergiliyor. Ancak kurumsal ortamlarda belirli bir alan, terminoloji veya iş sürecine uyum sağlamaları gerektiğinde, genel bilgileri çoğu zaman yetersiz kalıyor. Bu noktada fine-tuning, yani ince ayar süreci devreye giriyor. Fine-tuning sayesinde mevcut bir temel modeli, kendi verileriniz ve ihtiyaçlarınız doğrultusunda özelleştirmek

Read More
August 7, 2026

Doğal Dil İşleme (NLP) Çözümleri: Türkçe Metin Analizi ve Uygulamaları

Doğal Dil İşleme (NLP) Nedir? Doğal Dil İşleme (Natural Language Processing - NLP), bilgisayarların insan dilini anlaması, analiz etmesi ve yanıtlar üretmesi için kullanılan yapay zeka teknolojisidir. İşletmeler için bu teknoloji çok değerlidir: müşteri geri bildirimleri, sosyal medya paylaşımları ve yazılı iletişimler otomatik olarak analiz edilerek müşteri memnuniyeti artar, operasyon maliyetleri düşer ve gizli iş içgörüleri ortaya çıkar. Türkçe NLP: Neden Özel Zorluklar Vardır? Tü

Read More