Modal, 1 Ekim 2026’da Modal Clusters’ın genel kullanıma açıldığını duyurdu. Tek dekoratör @modal.clustered ile çok düğümlü GPU kümesi isteniyor; düğümler arası iletişim InfiniBand verbs üzerinden 6,4 Tbps’ye kadar çıkabiliyor ve PyTorch ile NCCL otomatik yapılandırılıyor.
Ne getiriyor?
Kümeler mevcut Modal ilkelilleriyle (Volumes, Cloud Bucket Mounts, Queues) entegre. İstekten saniyeler içinde küme ayağa kalkıyor, saniye bazlı faturalanıyor. RDMA sağlığı dahil otomatik GPU sağlık güvencesi genişletilmiş. rdma=True bayrağıyla bulutlara özgü sürücü ve ortam karmaşası gizleniyor; Modal, gVisor’a RDMA desteği ekleyip yukarı akışa katkıda bulunduğunu belirtiyor.
Müşteri örnekleri
Yazıda Decagon’un trilyon parametre ölçeğinde ince ayar, 1x’in NEO dünya modeli ön eğitimi ve Runway’in Gen-4.5 / Aleph 2.0 çok düğümlü çıkarımı örnekleniyor. Küme boyutu plan GPU limitleriyle sınırlı; tüm çalışma alanlarına açık.
Henüz yorum yok. İlk yorumu siz yapın!