Google'ın Gemini 3.5 Live Translate modeli, 70'ten fazla dilde neredeyse gerçek zamanlı, akıcı konuşma çevirisi yaparak Google Translate uygulaması, Gemini API ve Google Meet'te kullanıma sunuldu [4][6]. Eski sıra tabanlı sistemlerin aksine model, siz konuşmaya başlar başlamaz anında çeviri yapıyor; orijinal ses ton...

Create a landscape editorial hero image for this Studio Global article: What is Google's Gemini 3.5 Live Translate model, how does its streaming speech-to-speech translation work across more than 70 languages, an. Article summary: ## What It Is. Topic tags: general, general web, user generated, documentation. Reference image context from search candidates: Reference image 1: visual subject "# Google Launches Gemini 3.5 Live Translate in 70 Languages. Google has launched Gemini 3.5 Live Translate, a new AI powered speech translation model that enables near real time co" source context "Google Launches Gemini 3.5 Live Translate in 70 ..." Reference image 2: visual subject "Google Patches Chrome Zero Day Vulnerability Under Attack" source context "Google Launches Gemini 3.5 Live Translate in 70 ..." Style: premium digital editorial illustration, source-backed research mood, clean compositio
9 Haziran 2026 itibarıyla Google, şimdiye kadarki en iddialı anlık sesli çeviri yapay zeka modelini resmen yayınladı: Gemini 3.5 Live Translate. Geliştirici kodunda gemini-3.5-live-translate-preview olarak adlandırılan bu model, tek bir temel görev için optimize edildi: neredeyse sıfır gecikmeyle, akıcı konuşmayı anında çevirmek. 70'ten fazla dili ve 2.000'i aşkın dil çiftini destekleyen sistem, cümle sonunu bekleyip sonra çeviri yapan eski usul sistemlere alışan kullanıcılar için büyük bir devrim niteliğinde .
Karşınızdaki kişi cümlesini tamamlamadan siz çeviriyi duymaya başlıyorsunuz. Gemini 3.5 Live Translate, saniyeler içinde sesi işleyip çeviriye dökerek sohbetin akıcılığını ve doğallığını tam anlamıyla korumayı hedefliyor. Bu lansman, Aralık 2025'teki tanıtımla başlayan ve 2026 baharında Gemini 3.1 flash live modelleriyle devam eden aşamalı geliştirme sürecinin doruk noktası oldu .
Gemini 3.5 Live Translate'in temel yeniliği, sürekli ve çift yönlü çalışan akış mimarisi. Bu, bildiğiniz sıra tabanlı çeviri sistemlerinden kökten bir kopuşu ifade ediyor ve modelin bir dizi yeteneğin kusursuz birleşimine dayanıyor.
Model konuşan kişinin sözünü bitirmesini beklemiyor artık. Ses girdisini sürekli alırken eşzamanlı olarak çeviri üretimini başlatıyor. Google bu durumu “konuşmacının sadece saniyeler gerisinde kalmak” olarak tarif ediyor; bu da doğal bir sohbeti baltalayabilecek o rahatsız edici sessizlik anlarını tamamen ortadan kaldırıyor .
Artık hangi dilin konuşulduğunu manuel olarak seçmeniz gerekmiyor. Model, konuşulan dili anında ve otomatik olarak algılıyor. Bu durum, birden fazla dilin aynı anda konuşulduğu, örneğin uluslararası bir toplantı ortamında bile geçerliliğini koruyor; bu da onu dinamik ve gerçek dünya koşullarındaki konuşmalar için ideal hale getiriyor .
Kullanıcı deneyimi için hayati önem taşıyan bir diğer nokta, ortaya çıkan sesin robotik olmaması. Model, orijinal konuşmacının tonlamasını, konuşma hızını ve ses perdesini birebir koruyacak şekilde tasarlandı. Yani çeviriyi duyduğunuzda, bu bir metin-okuma motorundan çok, karşınızdaki kişinin gerçek sesine benzeyen, son derece doğal bir ton yakalanıyor .
70'ten fazla dil desteğiyle model, birbirleri arasında binlerce çift yönlü kombinasyonu kapsıyor. Her katılımcının, karşısındakinin söylediklerini kendi dilinde rahatça duyabildiği, karşılıklı ve akıcı diyaloglar için özel olarak hazırlanmış .
Geliştiriciler modele Gemini Live API aracılığıyla erişebiliyor. Sistem, belirli bir formatta ses girdisi talep ediyor: 16kHz örnekleme hızında, ham (raw), little-endian, 16-bit PCM mono ses. Çeviri sonucunda elde edilen ses çıktısı da yine ham 16-bit PCM olarak, ancak daha yüksek bir kalitede, 24kHz örnekleme hızında sunuluyor . Modelin bağlam penceresi 128.000 girdi jetonuna (token) ve 64.000 çıktı jetonuna kadar izin veriyor
.
Google'ın bu noktaya gelmesi planlı ve aşamalı bir sürecin sonucuydu. Gemini 3.5 model ailesi ilk kez Mayıs 2026'daki Google I/O geliştirici konferansında duyurulmuştu .
gemini-3.1-flash-live-preview adlı canlı ses modelinin yayınlandığını gösteriyor gemini-3.5-live-translate-preview modeli, Gemini Live API ve Google AI Studio aracılığıyla geliştiricilere ve dünya genelinde hem Android hem de iOS için Google Translate uygulaması güncellemesiyle tüm son kullanıcılara resmi olarak sunuldu Model, son kullanıcıdan kurumsal müşteriye ve geliştiricilere kadar çok geniş bir yelpazede, farklı erişim seviyeleriyle kullanıma sunuluyor.
Son kullanıcılar için en basit erişim noktası burası. Özellik, Google Translate uygulaması içinde küresel olarak dağıtıma çıkıyor. Kulaklığınızı takıp uygulamanın sol alt köşesindeki “Canlı çeviri” (Live translate) butonuna dokunmanız yeterli. Android tarafında ayrıca, telefonu normal bir arama yapar gibi kulağınıza götürdüğünüzde, çevirileri ahizeden dinlemenizi sağlayan eller serbest bir “dinleme modu” da kullanıma sunuluyor .
Geliştiriciler için model, herkese açık bir ön izleme (public preview) olarak sunuluyor. Bu, Gemini Live API'sini kullanan üçüncü parti uygulamalara ve servislere entegrasyonun önünü açıyor. Google AI Studio ise geliştiricilerin, modelin yeteneklerini test edip prototipleyebilecekleri bir sanal alan ortamı sağlıyor .
İş dünyası için erişim şimdilik biraz daha kısıtlı. Google Meet için Gemini 3.5 Live Translate, Haziran 2026'dan itibaren yalnızca seçili kurumsal müşterilere özel bir ön izleme (private preview) olarak sunulmaya başlanacak. Kullanıma açıldığında, bir konuşmacının dilini otomatik olarak algılayıp, toplantıdaki her katılımcı için kendi tercih ettiği dile, üstelik 2.000'den fazla dil çiftini kapsayacak şekilde anında çeviri yapabilecek . Daha geniş çaplı bir sürüm 2026'nın ilerleyen aylarında planlanıyor. Bu özellik; Google Workspace Business Standard ve Plus, Enterprise Standard ve Plus, Google AI Pro ve Google AI Ultra abonelerine açık olacak
.
Agora, Fishjam, LiveKit, Pipecat ve Vision Agents gibi gerçek zamanlı iletişim platformları, çeviri modelini kendi medya altyapılarına dahil etmek için çoktan Gemini Live API entegrasyonları üzerinde çalışıyor .
Gerçek dünyadaki en çarpıcı testlerden biri, Güneydoğu Asya’nın dev araç çağırma ve teslimat platformu Grab ile yürütülüyor. Grab, bu teknolojiyi yolcular ve sürücüler arasında gerçek zamanlı sesli çeviri sağlamak için pilot olarak kullanıyor. Platform, aylık 10 milyondan fazla sesli aramaya ev sahipliği yapıyor ve bu pilot uygulamanın hedefi, pek çok farklı dilin konuşulduğu (Tayca, Vietnamca, Malayca, Endonezce, Filipince vb.) parçalı bir pazardaki iletişim zorluklarını doğrudan çözmek .
Sıra tabanlı çeviriden akan çeviriye bu geçiş, kullanıcı deneyiminde köklü bir değişim anlamına geliyor. Modeli Google Translate ve Meet gibi yaygın ürünlere derinlemesine entegre edip bir geliştirici ekosistemine de açan Google, gerçek zamanlı konuşma çevirisini niş bir özellik olmaktan çıkarıp küresel iletişim için standart bir altyapı katmanına dönüştürüyor . Grab ile yapılan pilot uygulama bu anlayışın en somut kanıtı; anlık ve doğal sesli çeviriyi hoş bir yenilikten ziyade olmazsa olmaz bir servis haline getiriyor
.
Model tarafından üretilen tüm yapay zeka sesleri, kökeninin tespit edilebilir olmasını ve teknolojinin olası kötüye kullanımlarının önüne geçilmesini sağlamak amacıyla Google'ın SynthID teknolojisiyle filigranlanıyor. Sentetik ses teknolojisi giderek daha gerçekçi ve yaygın hale gelirken, bu tür bir önlem kritik bir adım olarak görülüyor .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Google'ın Gemini 3.5 Live Translate modeli, 70'ten fazla dilde neredeyse gerçek zamanlı, akıcı konuşma çevirisi yaparak Google Translate uygulaması, Gemini API ve Google Meet'te kullanıma sunuldu [4][6].
Google'ın Gemini 3.5 Live Translate modeli, 70'ten fazla dilde neredeyse gerçek zamanlı, akıcı konuşma çevirisi yaparak Google Translate uygulaması, Gemini API ve Google Meet'te kullanıma sunuldu [4][6]. Eski sıra tabanlı sistemlerin aksine model, siz konuşmaya başlar başlamaz anında çeviri yapıyor; orijinal ses tonunuzu, vurgularınızı ve konuşma hızınızı karşı tarafa doğal bir şekilde aktarıyor [12].
Teknoloji, aylık 10 milyondan fazla sesli çağrı alan Güneydoğu Asya merkezli ulaşım platformu Grab tarafından, özellikle şoför yolcu iletişimi için test ediliyor; Google Meet tarafında ise yıl sonuna doğru geniş çaplı...