CANLI
xAI, Imagine API’yi 2.0’a Yükseltmeye Hazırlanıyor: Görüntü ve Video Tek…·Microsoft MAI-Cyber-1-Flash’ı Duyurdu·Moonshot AI, Kimi K3 Model Ağırlıklarını ve Teknik Raporunu Açık…
26 Aug 2026 · 22:44 GMT+3
Ai Haber – Türkiyenin Yapay Zeka Haber Portalı
YAPAY ZEKA HABERLERI SAYI #2.209 26 Ağu 2026 · Çarşamba

Gemini 3.5 Transcribe Nedir? Google’dan Yeni Nesil Ses Transkripsiyonu

Google, yapay zeka destekli ses teknolojisinde önemli bir adım attı.

AiHaber Editör
Editör
3DK 2OKUMA
{"AIGC":{"Label":"1","ContentProducer":"MiniMax AI","ProduceID":"783e6259-0b75-4652-bbd7-4002176d09bd","ReservedCode1":"","ContentPropagator":"MiniMax AI","PropagateID":"783e6259-0b75-4652-bbd7-4002176d09bd","ReservedCode2":""}}

★ Hızlı Özet

  • Google, yapay zeka destekli ses teknolojisinde önemli bir adım attı.
  • Gemini 3.5 Transcribe Nedir?
  • Sistem şu özellikleri sunuyor: Yanlış başlangıçları düzeltme: Konuşmacının tamamlayamadığı cümleleri otomatik olarak temizler Doldurucu kel…
  • İki Farklı API Uç Noktası Google, farklı kullanım senaryoları için iki ayrı uç noktası sunuyor. Birincisi olan gemini-3.5-transcribe, bir sa…

Gemini 3.5 Transcribe

Google, yapay zeka destekli ses teknolojisinde önemli bir adım attı. Şirket, Gemini 3.5 Transcribe aracını API üzerinden erişime açarak, geliştiricilerin ve işletmelerin 85’ten fazla dilde akıllı ses çözümlemesi yapmasına olanak tanıdı.

Gemini 3.5 Transcribe Nedir?

Gemini 3.5 Transcribe, Google’ın yeni nesil ses-kelime çeviri sistemidir. Geleneksel ses tanıma araçlarından farklı olarak, bu araç yalnızca kelimesi kelimesine aktarım yapmaz; konuşmacının asıl niyetini anlayarak metne dönüştürür.

Sistem şu özellikleri sunuyor:

  • Yanlış başlangıçları düzeltme: Konuşmacının tamamlayamadığı cümleleri otomatik olarak temizler
  • Doldurucu kelimeleri ayıklama: “Şey”, “aaa”, “mmm” gibi ifadeleri metinden çıkarır
  • Sayı ve tarih biçimlendirme: Rakamları ve tarihleri standart formata dönüştürür
  • Özel kelime desteği: Şirketlere özel terminolojiyi tanıyabilir
  • Konuşmacı tanımlama: Çoklu konuşmacı içeren kayıtlarda her konuşmacıyı ayrı ayrı etiketler

İki Farklı API Uç Noktası

Google, farklı kullanım senaryoları için iki ayrı uç noktası sunuyor. Birincisi olan gemini-3.5-transcribe, bir saate kadar kayıtlı ses dosyalarını işleyebiliyor ve her kelime için zaman damgası ile konuşmacı kimliği sağlıyor. İkinci uç noktası gemini-3.5-transcribeLive ise gerçek zamanlı WebSocket akışı ile alt saniye gecikme süresinde canlı transkripsiyon imkanı sunuyor.

Bu iki uç noktasının kullanım alanları farklılık gösteriyor. Kayıtlı transkripsiyon için ilk seçenek, canlı görüşme veya etkileşim için ikinci seçenek tercih ediliyor. Şu an için bireysel canlı oturumlar en fazla 10 dakika ile sınırlı bulunuyor.

İşletmeler İçin Ne İfade Ediyor?

Google Gemini 3.5 Transcribe’ın piyasaya çıkması, ses tabanlı yapay zeka hizmetleri sunan birçok girişimi doğrudan etkileyecek. Podcast düzenleme, toplantı notu çıkarma, müşteri hizmetleri otomasyonu ve sağlık sektöründe ses kayıtlarının metne dönüştürülmesi gibi alanlarda yeni bir rekabet dönemi başlayacak.

Türk geliştiriciler için de önemli fırsatlar doğdu. Google’ın bu API’si, yerel dil desteği ve akıllı biçimlendirme özellikleriyle, Anadolu’nun dilleri de dahil olmak üzere çok dilli içerik üreten platformlar için güçlü bir altyapı sunuyor.

Fiyatlandırma ve Erişim

Gemini 3.5 Transcribe şu an API üzerinden aktif olarak erişime açık. Standart transkripsiyon için dakika başına fiyatlandırma uygulanıyor. Akıllı mod, standart moddan farklı olarak içerik analizi de yaptığından, kullanım senaryosuna göre maliyet değişkenlik gösterebiliyor.

Google’ın bu hamlesi, sesli yapay zeka pazarındaki rekabeti kızıştırırken, girişimciler ve kurumsal yazılım geliştiricileri için maliyet avantajı sağlayacak yeni nesil ses çözümlerinin önünü açıyor.

— Paylaş

Beğendiysen yay.

Yapay Zeka Sohbetlerinde
Sosyal Medyada

Tartışma

Bu habere emoji ile tepki ver

Hizli:

Henüz yorum yok. İlk yorumu siz yapın!

Yapıcı ve saygılı yorumlar bekliyoruz. Topluluk kuralları