Qwen3.8 Flash Next Acik Kaynak Olarak Sunuldu: Islem Maliyeti 9 Kat Dusuruyor
Alibaba, Qwen3.8 Flash Next modelini acik kaynak olarak yayinladi. Yeni nesil MiMo mimarisi ile donanim verimliligi tarihi duzeye tasiniyor. Model, sadece 6 milyar parametre ile islem yaparken toplamda 125 milyar parametrelik bir kapasiteyi yonetiyor. Bu yaklasim, yapay zeka alaninda yeni bir verimlilik standardi belirliyor.
Yeni Mimari: N-gram Embeddings Ile Devrim
Qwen3.8 Flash Next, gelismis MiMo mimarisi uzerine insa edildi. Modelin onemli ozellikleri arasinda 125 milyar toplam parametre, 6 milyar aktif parametre ve 51 milyar N-gram Embeddings bulunuyor. Ayrica Attention, Residual, Embedding ve Optimization katmanlarinda onemli yapisal iyilestirmeler yapildi.
Egitim Maliyeti 9 Kat Dusuruldu
Alibaba’nin yaptigi onyuzlu teste gore, Qwen3.8 Flash Next, Qwen3.7 Plus’a gore yuzde 89 daha dusuk egitim maliyetiyle karsilik verilebilir performans seviyesine ulasabiliyor. Maliyet tasarrufu orani gercekekten etkileyici: yalnizca 1/9’luk egitim gucu ile benzer sonuclar elde ediliyor.
Coding ve Cowork Alanlarinda Ilerleme
Yeni model ozellikle Coding ve Cowork gubrelerinde onemli iyilestirmeler sunuyor. ModelScope sayfasinda paylasilan bilgilere gore, yapay zeka dusuncesi artik daha dusunceli calisiyor ve uzun baglamli gubrelerde daha verimli performans gosteriyor.
Qwen4 Resmen Yolda
Resmi aciklamaya gore, Qwen3.8 Flash Next bir sonraki nesil modeller icin toplulugu hazirlik yapmasi amaciyla sunuldu. Alibaba, toplulugu erken donemde yeni mimariye alistirmak istiyor. aihaber.org uzerinden Qwen serisi hakkinda daha fazla bilgiye ulasabilirsiniz.
Henüz yorum yok. İlk yorumu siz yapın!