Özet: 30 Saniyede Gemini 3.8 TTS
  • Google, 23 Eylül 2026‘da iki yeni seslendirme modeli çıkardı: Gemini 3.8 Flash TTS ve Gemini 3.8 Flash-Lite TTS.
  • Ücretsiz kullanılabiliyor. Gemini API’nin ücretsiz kademesinde iki model de “Free of charge”. En kolay yol Google AI Studio.
  • Bedeli şu: ücretsiz kademede gönderdiğiniz metin Google’ın ürünlerini geliştirmek için kullanılabiliyor. Gizli metni buraya koymayın.
  • Ücretli kullanımda 1 saatlik ses Flash TTS ile yaklaşık 0,81 dolar, Flash-Lite ile 0,54 dolar. Bu fiyatlar 31 Aralık 2026’ya kadar geçerli, 1 Ocak 2027’de iki katına çıkıyor.
  • 30 saniyelik kayıttan ses klonlama var, ama sesin sahibinin sesli onay kaydı şart. Onay cümlesi Türkçe de okunabiliyor.
  • Ses klonlamanın ciddi bir gizlilik tarafı var: sesiniz biyometrik veri ve varsayılan olarak Google’da 1 yıl saklanıyor.

Google bu ay ses tarafında durmuyor. Önce Gemini 3.8 Flash, ardından Gemini 3.8 Live geldi, bugün de sıra metin okumaya geldi. Google’ın lansman yazısında duyurduğu Gemini 3.8 Flash TTS ve 3.8 Flash-Lite TTS, yazdığınız metni seslendiren, istediğiniz karakterde yeni bir ses tasarlayan ve 30 saniyelik bir kayıttan kendi sesinizi kopyalayan iki model.

Bu yazının derdi haber değil. Soru şu: bunu bugün, para vermeden, Türkçe bir metin için kullanabilir misiniz? Kısa cevap evet. Uzun cevap aşağıda.


Gemini 3.8 TTS Nedir?

İki model de aynı işi yapıyor ama farklı yere nişan alıyor:

Gemini 3.8 Flash TTSGemini 3.8 Flash-Lite TTS
Model kimliğigemini-3.8-flash-ttsgemini-3.8-flash-lite-tts
Ne içinKalite, oyunculuk, uzun anlatımHacim, hız, düşük maliyet
Dil sayısı (dokümana göre)130101
Son kullanıcı içinGemini NotebookGoogle Vids
Geliştirici içinGemini API, AI StudioGemini API, AI Studio

Google’ın tarifi net: sesli kitap, podcast, oyun karakteri gibi “oyunculuk” isteyen işlerde Flash TTS. Toplu seslendirme, dublaj ve sesli asistan gibi hacim işlerinde Flash-Lite. Flash-Lite ayrıca önceki gemini-3.1-flash-tts-preview modelinin doğrudan yerini alıyor.

Öne çıkan yenilikler:

  • 30 hazır stüdyo sesi ve bunun üstüne yüzlerce sesten oluşan genişletilmiş kütüphane. Google toplamda 2.000’den fazla hazır sesten bahsediyor.
  • Ses tasarımı: “Melbourne’lu enerjik bir DJ” gibi düz bir cümleyle sıfırdan yeni bir ses üretmek.
  • İki konuşmacılı sahne: Tek metinden, iki ayrı sesle doğal sırayla konuşan bir diyalog.
  • Satır içi etiketler: Metnin içine <laugh>, <sigh>, <short pause> yazarak gülme, iç çekme, kısa duraklama eklemek.
  • Saatlerce süren uzun anlatımda sesin kaymaması. Sesli kitap için asıl önemli olan bu.
0:00
Ses tasarımı: tek bir cümleden üretilen enerjik bir DJ sesi (sesi açın), Google

Reklam

Gemini 3.8 TTS Ücretsiz mi?

Evet, bir sınıra kadar. Google’ın Gemini API fiyat sayfasında iki modelin ücretsiz kademesi de hem girdi hem çıktı için “Free of charge” yazıyor. Kredi kartı girmeden, bir Google hesabıyla AI Studio’dan kullanabiliyorsunuz.

Bilmeniz gereken iki şey var:

  1. Ücretsiz kademede verileriniz ürün geliştirmede kullanılabilir. Fiyat tablosunda “Used to improve our products” satırı ücretsiz kademe için “Yes”, ücretli kademe için “No”. Kullanım şartlarına göre bu içerikleri insan değerlendiriciler de okuyabiliyor. Yani müşteri verisi, şirket içi metin ya da yayımlanmamış bir kitap bölümü seslendirecekseniz ücretsiz kademe doğru yer değil.
  2. Günlük sınır sayfada yazmıyor. Google, ücretsiz kademenin model bazındaki istek sınırlarını dokümanda listelemiyor, bunları AI Studio’daki hesabınızda gösteriyor. Uzun bir sesli kitabı tek oturumda bitirmeyi planlamayın.

Kod yazmadan, sadece son kullanıcı olarak denemek istiyorsanız ikinci yol Gemini Notebook. Google, Flash TTS’in Notebook’ta “herkes için” kademeli olarak açıldığını söylüyor.


Türkçe Destekliyor mu?

Evet. En net kanıt, 3.8 ile gelen ses klonlama özelliğinin dokümanında: Google, onay cümlesinin okunabildiği 30 dili tek tek listeliyor ve Türkçe (tr-TR) bunlardan biri. Türkçe onay cümlesi de hazır: “Bu sesin sahibi benim ve Google’ın bu sesi kullanarak sentetik bir ses modeli oluşturmasına izin veriyorum.”

TTS dokümanındaki 130 dillik genel tabloda Türkçe şu an görünmüyor, ama o tabloda lansmanda öne çıkarılan Vietnamca da yok. Yani genel tablo eksik yayımlanmış. Model metnin dilini kendisi algılıyor, ayrıca dil seçmeniz gerekmiyor.

Türkçe için elimizde olmayan tek şey kalite puanı: Google’ın yayımladığı dil bazlı sıralamada Türkçe yok. Uzun bir işe başlamadan önce iki üç cümlelik bir metinle deneyin, özel isimleri, kısaltmaları ve sayıları doğru okuyup okumadığına bakın.


AI Studio’da Ücretsiz Türkçe Seslendirme: Adım Adım

Google, bugünden itibaren AI Studio’da yeni bir ses oyun alanı (audio playground) açtı. Tasarımı bir ses stüdyosu gibi: ses seçiyor ya da tasarlıyor, sonra iki konuşmacılı bir senaryo düzenleyicide satır satır yönetiyorsunuz.

  1. aistudio.google.com adresine Google hesabınızla girin.
  2. Modeller arasından TTS‘i açın ve modeli seçin. Kalite için gemini-3.8-flash-tts, hız ve hacim için gemini-3.8-flash-lite-tts.
  3. Bir ses seçin. 30 hazır sesin her birinin bir karakteri var: Kore “kararlı”, Charon “bilgilendirici”, Sulafat “sıcak”, Achernar “yumuşak”. Haber ve eğitim metni için Charon ya da Iapetus, hikaye için Sulafat iyi bir başlangıç.
  4. Türkçe metninizi yapıştırın. 3.8 modelleri metni kelimesi kelimesine okuyor. “Heyecanlı söyle” gibi bir talimatı metnin içine yazarsanız onu da okur.
  5. Tonu metinden ayrı verin. Tüm cümleye yayılacak duygu, hız ve üslup ayrı bir stil talimatına gider (API’de bu style alanı). Anlık sesler ise metnin içine köşeli parantezle girer: Bir saniye... <short pause> duydun mu? <sigh>
  6. Oluşturun, dinleyin, indirin. API tarafında çıktı varsayılan olarak 24 kHz, mono WAV dosyası.

Türkçe metin için birkaç pratik ipucu:

  • Sayıları ve kısaltmaları yazıyla verin. “3.8” yerine “üç nokta sekiz”, “TBMM” yerine açık hali. Model çoğu zaman doğru okur, ama “çoğu zaman” sesli kitap için yetmez.
  • Karakter sesini baştan tasarlayın. Dokümanın önerisi de bu: her satıra uzun talimat yazmak yerine, karakteri bir kez ses tasarımıyla oluşturun, sonra hep o sesi kullanın.

Kod ile (Gemini API)

Geliştiriciyseniz AI Studio’dan ücretsiz bir API anahtarı alıp aynı işi Python ile yapabilirsiniz. Google’ın TTS dokümanındaki örneğin Türkçe metinli hali:

import base64
from google import genai

client = genai.Client()  # GEMINI_API_KEY ortam değişkenini okur

interaction = client.interactions.create(
    model="gemini-3.8-flash-tts",
    input=[{
        "type": "user_input",
        "content": [{
            "type": "text",
            "text": "Merhaba, Proje Defteri'ne hoş geldiniz!",
            "annotations": [{
                "type": "speech_metadata",
                "style": "warm and friendly",
            }],
        }],
    }],
    response_format={"type": "audio"},
    generation_config={"speech_config": [{"voice": "Kore"}]},
)

with open("seslendirme.wav", "wb") as f:
    f.write(base64.b64decode(interaction.output_audio.data))

Dokümandaki tüm style örnekleri İngilizce. Metin Türkçe olsa bile bu alanı İngilizce yazmak en güvenli yol. Önceki TTS modellerinden geçiyorsanız bir değişikliğe dikkat: 3.8 modelleri ham PCM değil, başlığı hazır WAV döndürüyor. Kendi kodunuzda WAV başlığı ekliyorsanız o adımı kaldırın.


30 Saniyede Ses Klonlama

En çok konuşulacak özellik bu olacak. Flash TTS ve Flash-Lite TTS, 30 saniyelik bir kayıttan sesinizin kopyasını çıkarabiliyor. AI Studio’daki ekran yaklaşık 20 saniyelik doğal konuşma öneriyor ve tekdüze okumak yerine bir hikaye anlatmanızı istiyor.

Ama bir kilit var: sesin sahibinin onayı. Örnek kaydı yükledikten sonra kısa bir onay cümlesini sesli okuyorsunuz ve sistem bu iki kaydın aynı kişiye ait olup olmadığını kontrol ediyor. Cümle 30 dilde okunabiliyor, Türkçe dahil. Google iki kaydın aynı mikrofonla, aynı ortamda alınmasını öneriyor, yoksa doğrulama takılabiliyor. Yani ünlü birinin sesini internetten indirip klonlamak bu akışla mümkün değil, olması da gerekmiyor.

0:00
AI Studio'da ses klonlama: önce örnek kayıt, sonra sesli onay, Google

Üretilen her ses dosyasına insan kulağının duymadığı bir SynthID filigranı ekleniyor, klonlanan seslere ayrıca C2PA künyesi de ekleniyor. Böylece sesin yapay zeka ile üretildiği sonradan tespit edilebiliyor. Bir projede en fazla 200 özel ses tutulabiliyor.

Gizlilik: Sesinizi Vermeden Önce Bilmeniz Gerekenler

Metin seslendirmek ile sesinizi klonlatmak aynı şey değil. Birincisinde Google’a bir metin veriyorsunuz, ikincisinde sizi tanımlayan bir biyometrik veri veriyorsunuz. Google’ın kendi dokümanı da klonlanan sesler için “biyometrik ses profili” ifadesini kullanıyor. Şifre değiştirilir, ses değiştirilmez.

  • Onay cümlesi Google’a verilmiş bir izin. Okuduğunuz cümle sadece “bu ses benim” demiyor, Google’ın bu sesle sentetik bir ses modeli oluşturmasına izin verdiğinizi de söylüyor. Kaydetmeden önce bunu bilerek okuyun.
  • Ses profili varsayılan olarak 1 yıl saklanıyor. Klonlanan ses, varsayılan ayarda Google’ın sunucusunda, projenizde duruyor. API’de bunu istemeyenler için bir seçenek var: store=False ile ses profili sunucuda tutulmuyor, şifreli bir anahtar olarak sizde kalıyor ve 7 gün geçerli oluyor. İşiniz bitince kayıtlı sesi voices.delete() ile silebiliyorsunuz.
  • Ücretsiz kademe ayrı bir risk. Gemini API kullanım şartları, ücretsiz kademede ve AI Studio’da gönderdiğiniz içeriğin Google ürünlerini geliştirmek için kullanıldığını ve insan değerlendiricilerin girdiyi ve çıktıyı okuyabileceğini söylüyor. Veri önce hesabınızdan ve API anahtarınızdan ayrılıyor, ama şartların kendi cümlesi net: ücretsiz kademeye hassas, gizli ya da kişisel veri göndermeyin. Ses kaydı kişisel veri. Kendi sesinizi ya da müşterinizin sesini kalıcı olarak klonlayacaksanız faturalandırması açık bir projeyle ücretli kademeyi kullanın.
  • Ses kimliği anahtarınıza bağlı. Klonlanan ses projenizde bir kimlikle duruyor. API anahtarınız sızarsa, anahtarı ele geçiren sizin sesinizle istediği cümleyi okutabilir. Anahtarı kodun içine gömmeyin, paylaşmayın.
  • Başkasının sesi başka bir konu. Türkiye’de KVKK, 6. maddesinde biyometrik veriyi özel nitelikli kişisel veri sayıyor. Bir çalışanın, seslendirme sanatçısının ya da aile üyenizin sesini klonlayacaksanız o kişinin açık rızasını yazılı olarak alın. Onay kaydını o kişinin kendisinin okuması zaten şart.
  • Filigran önlemez, sadece ele verir. SynthID, sahte bir sesin sonradan yapay zeka ile üretildiğinin tespit edilmesine yarıyor. Birinin o sesi dinleyip kandırılmasını engellemiyor.

Kısacası: denemek için kendi sesinizi klonlayın, işiniz bitince silin.


Fiyat: 1 Saatlik Seslendirme Kaç Dolar?

Ücretsiz kademe yetmezse ücretli kademe devreye girer. Google ses çıktısını token ile ölçüyor: 1 saniye ses 25 token, yani 1 dakika 1.500 token. Metin girdisi bunun yanında önemsiz kalıyor.

ModelSes çıktısı (1M token)1 dakika ses1 saat ses
3.8 Flash TTS (2026 sonuna kadar)9 $~0,0135 $~0,81 $
3.8 Flash TTS (1 Ocak 2027’den itibaren)18 $~0,027 $~1,62 $
3.8 Flash-Lite TTS (2026 sonuna kadar)6 $~0,009 $~0,54 $
3.8 Flash-Lite TTS (1 Ocak 2027’den itibaren)12 $~0,018 $~1,08 $

Metin girdisi iki modelde de 2026 sonuna kadar milyon token başına 0,50 $, sonra 1 $. 10 saatlik bir sesli kitap bugün Flash TTS ile yaklaşık 8 dolara çıkıyor. Büyük bir iş planlıyorsanız yıl bitmeden yapın.


ElevenLabs’e Karşı Nerede Duruyor?

Türkiye’de “yapay zeka seslendirme” araması yapan herkesin karşısına ilk çıkan isim ElevenLabs. Karşılaştırma iki başlıkta anlamlı:

Ücretsiz kullanım: ElevenLabs’in fiyat sayfasına göre ücretsiz plan ayda 10 bin kredi veriyor. Bu, arayüzde yaklaşık 10 dakika seslendirme demek ve ticari kullanım lisansı ücretsiz planda yok. Anlık ses klonlama ayda 6 dolarlık Starter planıyla başlıyor. Gemini’nin ücretsiz kademesi ise dakika sınırı yayımlamıyor, sınırlar hesabınıza göre AI Studio’da görünüyor.

Kalite: Google’ın paylaştığı Hume AI kalite testinde genel puan Gemini 3.8 Flash TTS için 0,920, Flash-Lite için 0,914, ElevenLabs v3 için 0,706. “İnsan benzeri çeşitlilik” satırında ise ElevenLabs v3 5,00 ile önde, Gemini 4,58’de kalıyor.

Hume AI metin okuma kalite testi tablosu: Gemini 3.8 Flash TTS genel puanda 0,920 ile birinci, ElevenLabs v3 0,706
Hume AI metin okuma kalite testi. Kaynak: Google. Tabloyu Google yayımladı, bağımsız bir tekrar henüz yok.

Voice Arena’daki körlemesine insan tercihi testinde de Gemini modelleri Japonca, Brezilya Portekizcesi, Vietnamca, Arapça, Hintçe ve Meksika İspanyolcasında önde. Türkçe bu listede yok, yani Türkçe kalite için elimizde bir sayı yok. Kulağınız son hakem.

Voice Arena metin okuma sıralaması: yedi dilde Gemini 3.8 Flash TTS ve Flash-Lite TTS, ElevenLabs v3 ve OpenAI gpt-4o-mini-tts'in önünde
Voice Arena dil bazında sıralama. Kaynak: Google.

OpenAI tarafında ücretsiz deneme için OpenAI.fm hâlâ bir seçenek.


Sıkça Sorulan Sorular (SSS)

Gemini 3.8 TTS ücretsiz mi?

Evet. Gemini API’nin ücretsiz kademesinde Flash TTS ve Flash-Lite TTS hem girdi hem çıktı için ücretsiz. Google AI Studio’dan bir Google hesabıyla kullanabilirsiniz. Ücretsiz kademede gönderilen veriler Google’ın ürünlerini geliştirmek için kullanılabiliyor ve istek sınırları hesabınıza göre AI Studio’da gösteriliyor.

Gemini ile Türkçe seslendirme yapılır mı?

Evet. Google, Gemini 3.8 ile gelen ses klonlama özelliğinin onay cümlesini okuyabileceğiniz 30 dil arasında Türkçeyi (tr-TR) resmen listeliyor ve model metnin dilini kendisi algılıyor. Önceki Gemini TTS modelleri de Türkçeyi destekliyordu. Türkçe için yayımlanmış bir kalite puanı yok, uzun bir işe başlamadan kısa bir metinle deneyin.

Gemini ile ses klonlama nasıl yapılır?

Google AI Studio’da ses klonlama (Voice Replication) ekranında yaklaşık 20-30 saniyelik doğal bir konuşma kaydı yüklüyorsunuz, ardından sesin sahibi kısa bir onay cümlesini sesli okuyor. Cümle Türkçe de okunabiliyor. İki kayıt eşleşirse ses oluşturuluyor ve varsayılan olarak bir yıl saklanıyor. Başkasının sesini onayı olmadan klonlamak bu akışla mümkün değil.

Gemini ile ses klonlama güvenli mi?

Ses biyometrik bir veri ve Google’ın dokümanı da bunu “biyometrik ses profili” olarak anıyor. Onay cümlesiyle Google’a sesinizden sentetik model oluşturma izni veriyorsunuz ve profil varsayılan olarak bir yıl saklanıyor. API’de store=False ile sunucuda saklamayı kapatabilir, voices.delete() ile silebilirsiniz. Ücretsiz kademede veriler ürün geliştirmede kullanılabildiği için hassas sesler için ücretli kademe daha temkinli.

Gemini 3.8 Flash TTS ile Flash-Lite TTS arasındaki fark ne?

Flash TTS kalite ve oyunculuk için: sesli kitap, podcast, karakter sesi, zor telaffuzlar. Flash-Lite TTS hacim ve maliyet için: toplu seslendirme, dublaj, sesli asistan. Flash-Lite yaklaşık üçte bir daha ucuz ve dokümana göre daha az dili destekliyor.

1 saatlik yapay zeka seslendirmesi kaç dolar?

Gemini 3.8 Flash TTS ile yaklaşık 0,81 dolar, Flash-Lite TTS ile yaklaşık 0,54 dolar. Bu fiyatlar 31 Aralık 2026’ya kadar geçerli, 1 Ocak 2027’den itibaren iki katına çıkıyor. Hesap 1 saniye sesin 25 token sayılmasına dayanıyor.