CANLI
xAI, Imagine API’yi 2.0’a Yükseltmeye Hazırlanıyor: Görüntü ve Video Tek…·Microsoft MAI-Cyber-1-Flash’ı Duyurdu·Moonshot AI, Kimi K3 Model Ağırlıklarını ve Teknik Raporunu Açık…
18 Sep 2026 · 17:43 GMT+3
Ai Haber – Türkiyenin Yapay Zeka Haber Portalı
MODEL HABERLERI SAYI #2.631 18 Eyl 2026 · Cuma

Qwen3.8-Omni-Flash: yerel çoklu-modal model, 1M bağlam ve ses-görüntü ajanları

Qwen ekibi, bir sonraki nesil yerel çoklu-modal modelini duyurdu: Qwen3.8-Omni-Flash.

AiHaber Editör
Editör
2DK

★ Hızlı Özet

  • Qwen ekibi, bir sonraki nesil yerel çoklu-modal modelini duyurdu: Qwen3.8-Omni-Flash.
  • Ne getiriyor? Model metin, görüntü, ses ve video girişlerini destekliyor; 1M token bağlam penceresi sunuyor. Qwen’e göre 29 değerlendirmede …
  • Ses-görüntü ajanları ve ölçümler Ses-görüntü ajanları, kodlama ve uzun ufuklu görevlerde WildClawBench-MM’de 36,5 puan, AgenticVBench’te 22,…
  • Uzun form ve ajanlı anlama Qwen3.8-Omni-Flash, kontrol edilebilir ses-görüntü altyazısından ajanlı kanıt toplamaya, toplantı tutanaklarından…

Qwen ekibi, bir sonraki nesil yerel çoklu-modal modelini duyurdu: Qwen3.8-Omni-Flash. Hedef, gerçek üretim senaryolarında ajan yeteneklerini güçlendirmek; çoklu-modal modelleri yalnızca “içeriği anlamak”tan, “görev planlayıp araç çağırarak yaratıcı işi tamamlamaya” taşımak.

Ne getiriyor?

Model metin, görüntü, ses ve video girişlerini destekliyor; 1M token bağlam penceresi sunuyor. Qwen’e göre 29 değerlendirmede ortalama skor, Qwen3.5-Omni-Plus’a göre yüzde 25’ten fazla artıyor. API tarafında saatlik ses girişi fiyatı yüzde 98’den, saatlik ses-görüntü girişi fiyatı yüzde 93’ten fazla düşürüldü (Qwen’in kendi fiyatlandırma yöntemine göre).

Ses-görüntü ajanları ve ölçümler

Ses-görüntü ajanları, kodlama ve uzun ufuklu görevlerde WildClawBench-MM’de 36,5 puan, AgenticVBench’te 22,3 puan iyileşme; UniClawBench’te 69,6 skor bildiriliyor. Uzun form ses/ses-görüntü anlama, akıl yürütme, altyazı ve çok konuşmacılı tanıma da güçleniyor. Örneğin LongAudioSpan’te +8,3, OmniVideoBench’te +9,6 puan; OmniCap-IF CSR/ISR’de +8,5 / +14,1; AliMeeting DER / cpWER 88,11 / 89,61’den 3,35 / 17,18’e iniyor. Qwen, ses-görüntü performansının Gemini 3.8 Flash’e yaklaştığını ve genel ses performansının onu geçtiğini öne sürüyor.

Uzun form ve ajanlı anlama

Qwen3.8-Omni-Flash, kontrol edilebilir ses-görüntü altyazısından ajanlı kanıt toplamaya, toplantı tutanaklarından video merkezli derin araştırmaya kadar uzun form iş akışlarını hedefliyor. OmniVideoBench’te ajanlı anlama doğruluğu 63,4’ten 67,8’e çıkarken sorgu başına token tüketimi yaklaşık yüzde 45,7 azalıyor (145.736 → 79.117). Toplantılarda konuşmacı segmentasyonu, transkripsiyon ve kimlik hizalaması uçtan uca destekleniyor; görsel bağlamla referans belirsizlikleri giderilebiliyor.

Ekosistem: MM-Plugins ve Live Harness

Uzun form ses/video için Qwen-MM-Plugins genişletildi; sürekli gerçek zamanlı çoklu-modal etkileşim için Qwen-Live Harness açık kaynaklandı. Model Qianwen AI Platform üzerinden Qwen3.8-Omni-Flash API ve Realtime API ile kullanıma açıldı.

Kaynak: Qwen – Qwen3.8-Omni-Flash: Omni Senses. Agentic Delivery.

— Paylaş

Beğendiysen yay.

Yapay Zeka Sohbetlerinde
Sosyal Medyada

Tartışma

Bu habere emoji ile tepki ver

Hizli:

Henüz yorum yok. İlk yorumu siz yapın!

Yapıcı ve saygılı yorumlar bekliyoruz. Topluluk kuralları