DeepSeek Harness, 19 Ağustos 2026’da yayınlanan yeni bir güncelleme ile çok modlu destek kazandı. Agent artık PNG, JPEG, WebP ve GIF formatlarındaki görselleri okuyabiliyor ve bunları gerçek bir ImageBlock olarak model bağlamına entegre edebiliyor.
DeepSeek Harness Nedir?
DeepSeek Harness (DSH), Çinli yapay zeka şirketi DeepSeek tarafından geliştirilen bir agent geliştirme çerçevesidir. Geliştiricilere güçlü araçlar ve API desteği sunan bu platform, agent tabanlı yapay zeka uygulamaları için önemli bir altyapı sağlamaktadır.
Yeni Çok Modlu Güncelleme: feat(llm-deepseek): support multimodal requests
19 Ağustos 2026 tarihinde DeepSeek Harness kod tabanına eklenen bu güncelleme, sistemin görsel işleme yeteneklerini temelden değiştiriyor. Daha önce agent yalnızca metin tabanlı işlemler gerçekleştirebiliyordu. Yeni güncelleme ile birlikte artık agent, çalışma alanındaki görselleri okuyabilir ve analiz edebilir hale geldi.
Güncellemenin en dikkat çekici özelliği, görsellerin eski sistemlerde olduğu gibi OCR’a tabi tutulup metne dönüştürülmemesidir. Bunun yerine, agent görsel dosyayı kendi Attachment Store’una kaydederek gerçek bir ImageBlock oluşturur. Bu görsel blok, agent’ın Tool Loop döngüsünde Tool Result olarak döndürülür ve sonraki model çağrısında doğrudan model bağlamına girer.
read_image Aracı: Nasıl Çalışıyor?
Yeni sistemde agent, read_image aracını kullanarak çalışma alanındaki görselleri okur. Desteklenen formatlar şunlardır:
- PNG
- JPEG
- WebP
- GIF
Agent’a örneğin “Bu sayfaatchesinde ne sorun var” gibi bir talimat verildiğinde, agent görseli okur, Attachment Store’a kaydeder ve ImageBlock oluşturarak modele iletir. Model, görsel içeriği doğrudan bağlamında değerlendirerek ilgili yanıtı üretir.
Görsel İşlemenin Teknik Detayları
Önceki nesil sistemlerde görseller genellikle iki şekilde işleniyordu: OCR ile metne dönüştürme veya yalnızca dosya yolunu döndürme. Her iki yöntem de agent’ın görsel içeriği tam olarak anlamasını engelliyordu.
DeepSeek Harness’in yeni yaklaşımında ise görseller, 20 MiB’a kadar olan yükler için tam çözünürlüklü olarak agent bağlamına entegre edilir. Bu sayede model, görselin tamamını değerlendirerek daha doğru ve bağlama uygun yanıtlar üretebilir.
Neden Bu Güncelleme Önemli?
Çok modlu yapay zeka desteği, modern agent sistemlerinde kritik bir gereksinim haline gelmiştir. Agent’ların:
- Kullanıcı arayüzüatchesini analiz etmesi
- Doküman görsellerini anlaması
- Grafik ve diyagramları değerlendirmesi
- Ekran görüntülerindeki hataları tespit etmesi
gibi görevleri yerine getirebilmesi için görsel işleme yeteneklerine sahip olması şarttır. DeepSeek’in bu güncellemesi, agent geliştiricilerine önemli bir avantaj sağlamaktadır.
Gelecek Perspektifi
DeepSeek, son dönemde hızlı bir gelişim sürecinden geçmektedir. Çok modlu desteğin eklenmesi, şirketin agent ekosistemini daha da güçlendireceğe benzemektedir. Özellikle görsel tabanlı agent uygulamaları için bu güncelleme, yeni kullanım senaryolarının önünü açacaktır.
DeepSeek Harness’in bu hamlesi, yapay zeka agent’larının metin ötesi yetenekler kazanması yolunda atılan önemli bir adımdır. Agent’ların artık yalnızca okuyup yazmakla kalmayıp, gerçek anlamda “görebildiği” bir döneme geçiş yapıyoruz.
Kaynak: @MaxForAI (X/Twitter), 19 Ağustos 2026
Henüz yorum yok. İlk yorumu siz yapın!