Gemini 3.8 Live Nedir? Sesli Ajan Modeli

Gemini 3.8 Live Nedir? Sesli Ajan Modeli

Özet: 30 Saniyede Gemini 3.8 Live Google, 15 Eylül 2026‘da iki sesli modeli kararlı (GA) sürüme aldı: gemini-3.8-live ve gemini-3.8-live-extended-thinking. İkisi de ses-ses modeli. Araya konuşma tanıma ve seslendirme motoru koymuyorsunuz; mikrofonun çıktısı doğrudan modele gidiyor, model doğrudan ses üretiyor. Fiyat dakika başına da ölçülebiliyor: ses girdisi 0,005 dolar/dk, ses çıktısı 0,018 dolar/dk. Ücretsiz kademe var. İki modelin farkı tek kelimeyle düşünme. Standart sürümde thinkingLevel yok, Extended Thinking’de low / medium / high var. Extended Thinking, Artificial Analysis’in Ses-Ses Kalite Endeksi’nde 82,6 puanla birinci. Standart 3.8 Live ise Speech Agent Arena’da ikinci. Konuşma ortasında 97 dil arasında kendiliğinden geçiş yapıyor, Türkçe dahil. Sıkı bir sınır var: sıkıştırma açmazsanız sadece sesli oturum 15 dakika, sesli + görüntülü oturum 2 dakika sürüyor. Google’ın Eylül temposu 3.8 Flash ile bitmemiş. Bugün, 15 Eylül 2026’da, Gemini API’nin Live tarafına iki yeni kararlı model geldi: Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking. ...

15 Eylül 2026 ·  11 dk ·  2272 sözcük
OpenAI.fm Nedir? Sesli Yapay Zeka Platformu Rehberi

OpenAI.fm Nedir? Sesli Yapay Zeka Platformu Rehberi

Herkese merhaba! Bu yazıda son dönemde çok aranan OpenAI.fm platformunu inceliyoruz: nedir, nasıl kullanılır, hangi sesler var ve API tarafında neler sunuyor? Hadi başlayalım! 🎙️ Önce dinleyin, aşağıdaki ses OpenAI.fm ile birkaç saniyede üretildi: OpenAI.fm örneği: Ash sesi, warm podcast host talimatı 0:00 OpenAI.fm Nedir? OpenAI.fm, OpenAI’ın yeni nesil ses modellerini herkesin ücretsiz deneyebilmesi için yayınladığı interaktif bir web platformudur. openai.fm adresine girip yazdığınız metni saniyeler içinde seslendirebilir, üstelik sesin nasıl konuşacağını da (ton, hız, duygu, karakter) kendiniz belirleyebilirsiniz. ...

20 Temmuz 2026 ·  7 dk ·  1417 sözcük
Wan Streamer: Yapay Zeka ile Görüntülü Görüşme Devrimi

Wan Streamer: Yapay Zeka ile Görüntülü Görüşme Devrimi

Geleceğin görüntülü asistanlarıyla tanışmaya hazır mısınız? Bugüne kadar yapay zeka ile “görüntülü görüşme” denildiğinde, birbirini bekleyen hantal sistemler akla gelirdi. Önce ses dinlenir, metne çevrilir, cevap düşünülür ve en son video animasyonu üretilirdi. Bu gecikmeli yapı artık tarihe karışıyor. Wan-Streamer, dünyanın ilk uçtan uca akışlı (native-streaming) yapay zeka modeli. Dili, sesi ve videoyu tek bir model içinde aynı anda işleyerek, tam çift yönlü (full-duplex) bir görüntülü görüşme deneyimi sunuyor. Gerçek Zamanlı Yapay Zeka Asistanı: Nasıl Çalışır? Wan-Streamer, gelişmiş bir gerçek zamanlı yapay zeka asistanı olarak; siz konuşurken sizi tıpkı bir insan gibi dinler, mimikleriyle anında tepki verir. Araya girdiğinizde veya sözünü kestiğinizde bunu doğal bir şekilde fark ederek konuşmayı kesintisiz yönetir. Wan-Streamer genel mimarisi, kaynak Öne Çıkan Özellikleri Işık Hızında Tepki: Saniyede 25 kare hızında (FPS) çalışıyor ve ağ gecikmesi dahil 1 saniyenin altında tepki veriyor. Kusursuz Senkronizasyon: Dudak hareketleri, yüz ifadeleri ve ses tonu eşzamanlı üretiliyor. Tek Bir Altyapı: Ses (TTS/ASR) ve animasyon motorları aradan kalkıyor. Ses, metin ve video “tek bir Transformer” modeliyle anında işleniyor. Aktif Dinleme: Asistanınız donup kalmıyor; sizi dinlerken göz teması kuruyor, mimikleriyle tepki veriyor ve araya girdiğinizde susabiliyor. Sınırsız Çeşitlilik: Bu tek sistem üzerinden birbirinden farklı yüzlere, ses tonlarına ve ortamlara sahip dijital insanlar yaratılabiliyor. Aşağıdaki videodan modelin gerçek zamanlı görüşme (real-time recording) demosunu izleyebilirsiniz: ...

26 Haziran 2026 ·  2 dk ·  336 sözcük