Herkese merhaba! Bu yazıda son dönemde çok aranan OpenAI.fm platformunu inceliyoruz: nedir, nasıl kullanılır, hangi sesler var ve API tarafında neler sunuyor? Hadi başlayalım! 🎙️

Önce dinleyin, aşağıdaki ses OpenAI.fm ile birkaç saniyede üretildi:

OpenAI.fm örneği: Ash sesi, warm podcast host talimatı 0:00

OpenAI.fm Nedir?

OpenAI.fm, OpenAI’ın yeni nesil ses modellerini herkesin ücretsiz deneyebilmesi için yayınladığı interaktif bir web platformudur. openai.fm adresine girip yazdığınız metni saniyeler içinde seslendirebilir, üstelik sesin nasıl konuşacağını da (ton, hız, duygu, karakter) kendiniz belirleyebilirsiniz.

Platformun arkasında OpenAI’ın üç yeni ses modeli çalışıyor:

  • GPT-4o-mini-tts: Metni sese çeviren (text-to-speech) ve konuşma tarzını yönlendirebildiğiniz model. OpenAI.fm’in kalbi bu.
  • GPT-4o-transcribe ve GPT-4o-mini-transcribe: Konuşmayı metne çeviren (speech-to-text), eski Whisper modellerinden belirgin şekilde daha başarılı modeller.
Kısaca: OpenAI.fm ne işe yarar?
Yazdığınız metni seçtiğiniz ses karakteriyle okutur. “Heyecanlı bir bilim insanı gibi konuş” veya “fısıldayarak, sakinleştirici bir tonda oku” gibi serbest talimatlar verebilirsiniz. Tamamen tarayıcıda çalışır, üyelik gerektirmez.

OpenAI.fm Nasıl Kullanılır?

OpenAI.fm arayüzü: turuncu temalı ses karakteri seçimi, vibe talimat alanı ve Generate düğmesi
OpenAI.fm arayüzü (openai.fm)

Turuncu temalı, retro radyo havasındaki arayüz oldukça basit:

  1. openai.fm adresine gidin
  2. Hazır ses karakterlerinden birini seçin: Alloy, Ash, Ballad, Coral, Echo, Fable, Onyx, Nova, Sage, Shimmer, Verse
  3. Hazır metinlerden birini seçin veya kendi metninizi yazın
  4. “Vibe” bölümünden konuşma tarzı talimatı ekleyin (en yenilikçi kısım burası!)
  5. Generate tuşuna basın ve oluşan sesi dinleyin

Oluşturduğunuz sesi indirebilir veya bağlantısını paylaşabilirsiniz.

Profesyonel iş için: Cedar ve Marin sesleri
OpenAI’ın 2026’da tanıttığı en doğal iki ses olan Cedar (sıcak erkek sesi) ve Marin (parlak kadın sesi) yalnızca Realtime API üzerinden kullanılabiliyor. OpenAI, üretim seviyesi sesli asistanlar için bu iki sesi öneriyor.

Konuşma Tarzı Talimatları

GPT-4o-mini-tts’in asıl farkı şu: modele sadece ne söyleyeceğini değil, nasıl söyleyeceğini de anlatabiliyorsunuz. Birkaç örnek:

  • Duygu durumları: “Çok heyecanlı ve biraz gergin konuş”, “Sakin, yatıştırıcı bir tonda fısılda”
  • Karakter sesleri: “Yaşlı bir bilge gibi ağır ve otoriter konuş”, “Robot gibi monoton ve mekanik konuş”
  • İş senaryoları: “Profesyonel bir sunucu gibi net ve enerjik ol”, “Empatik bir terapist gibi yumuşak konuş”
  • Yaratıcı anlatım: “Epik bir film fragmanı seslendirmeni yap”, “Çocuk kitabı okur gibi sıcak ve merak uyandırıcı konuş”

Talimatlar tamamen serbest metin; modelin anlamasını bekleyebilirsiniz. Türkçe metinleri de seslendirebiliyor.

Ses Modelleri Ne Kadar Başarılı?

Konuşma tanıma tarafında FLEURS değerlendirmesine göre yeni modeller Whisper’ı tüm dillerde geride bırakıyor. WER (kelime hata oranı) değerleri, düşük olan daha iyi:

DilGPT-4o-transcribeGPT-4o-mini-transcribeWhisper-large-v3
İngilizce0.0350.0370.045
Türkçe0.0850.0890.113
İspanyolca0.0490.0510.068
Fransızca0.0630.0650.082
Rusça0.0780.0820.104
Japonca0.0970.1020.138

Türkçede hata oranının Whisper’a göre yaklaşık dörtte bir azalması, Türkçe sesli uygulamalar geliştirenler için önemli bir kazanım.

GPT-4o-transcribe ve GPT-4o-mini-transcribe modellerinin Whisper ile farklı dillerdeki benchmark karşılaştırma grafiği
Görsel, OpenAI Benchmarks

Geliştiriciler İçin: API Kullanımı

OpenAI.fm’de oynadığınız her şeyi kendi uygulamanızda da kullanabilirsiniz. Arayüzdeki “Show code” düğmesi, o anki ses ve talimat ayarlarının Python, JavaScript veya cURL karşılığını verir:

from openai import OpenAI
client = OpenAI()

response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  voice="alloy",
  instructions="Heyecanlı bir bilim insanı gibi, yüksek enerjiyle ve merak uyandırarak konuş",
  input="Bugün çığır açan bir keşif yaptım! Düşünün, maddenin yapısını tamamen değiştiren bir parçacık!"
)

response.stream_to_file("cikti.mp3")

Fiyatlandırma (Temmuz 2026 Güncel)

Fiyatlar token bazlı hesaplanıyor; tabloda dakika başına yaklaşık maliyetleri de görebilirsiniz:

ModelGörevToken FiyatıYaklaşık Maliyet
gpt-4o-mini-ttsMetni seslendirme$0.60 / 1M metin girdisi + $12 / 1M ses çıktısı~1.5 cent / dakika
gpt-4o-transcribeKonuşmayı metne çevirme$2.50 / 1M girdi + $10 / 1M çıktı~0.6 cent / dakika
gpt-4o-mini-transcribeKonuşmayı metne çevirme$1.25 / 1M girdi + $5 / 1M çıktı~0.3 cent / dakika
gpt-realtime-whisperCanlı transkripsiyon-~1.7 cent / dakika
gpt-realtime-translateCanlı sesli çeviri-~3.4 cent / dakika

Somut örnek: 1.000 kelimelik bir blog yazısını seslendirmek yaklaşık 5 dakikalık ses üretir ve gpt-4o-mini-tts ile 8 cent civarına mal olur. OpenAI.fm üzerindeki deneme kullanımı ise ücretsizdir.

Son Gelişmeler: OpenAI Ses Modellerinde 2026 Güncellemeleri

OpenAI.fm’in arkasındaki ses teknolojisi hızla gelişmeye devam ediyor. 2026’daki önemli güncellemeler:

Mayıs 2026 - Realtime ailesi yenilendi: OpenAI, API’ye üç yeni gerçek zamanlı ses modeli ekledi:

  • gpt-realtime-2: GPT-5 sınıfı akıl yürütme yapabilen ilk ses modeli. Karmaşık istekleri sesli sohbet sırasında çözebiliyor.
  • gpt-realtime-translate: 70’ten fazla dilden 13 dile, konuşmacıyla eş zamanlı canlı çeviri yapıyor.
  • gpt-realtime-whisper: Konuşmacı konuşurken canlı akış halinde transkripsiyon üretiyor.

Temmuz 2026 - GPT-Live tanıtıldı: OpenAI, aynı anda hem konuşup hem dinleyebilen (full-duplex) GPT-Live-1 ve GPT-Live-1 mini modellerini duyurdu ve dünya genelinde ChatGPT kullanıcılarına sunmaya başladı. Araya girip sözünü kesebiliyorsunuz, model doğal şekilde uyum sağlıyor. Detaylı incelememiz için GPT-Live yazımıza göz atabilirsiniz.

Yeni sesler - Cedar ve Marin: Realtime API ile birlikte gelen bu iki ses, doğal duraklamaları ve dolgu seslerini insan gibi kullanarak “yapay ses” hissini büyük ölçüde azaltıyor. Müşteri hizmetleri, hukuk ve sağlık gibi kurumsal senaryolar için öneriliyorlar.

Sesli Ajanlar (Voice Agents)

Bu modellerin asıl hedefi sesli ajanlar: kullanıcıyı sesle anlayıp sesle yanıtlayan yapay zeka sistemleri. İki yaklaşım var:

  1. Speech-to-Speech: Ses girdisini doğrudan anlayıp sesli yanıt üretir. Daha düşük gecikme, daha doğal etkileşim. ChatGPT’nin gelişmiş ses modu bu yöntemi kullanıyor.
  2. Zincir yöntemi: Konuşma tanıma → LLM → Seslendirme şeklinde çalışır. Modüler olduğu için mevcut metin tabanlı bir ajanı birkaç satır kodla sesli ajana çevirebilirsiniz.

OpenAI’ın Agents SDK’sı ile zincir yöntemini kurmak oldukça kolaylaştı; gpt-4o-transcribe girişte, gpt-4o-mini-tts çıkışta olacak şekilde mevcut iş akışınıza eklemeniz yeterli.

Nerelerde Kullanılır?

  • Müşteri hizmetleri: Doğal ve empatik sesli destek sistemleri, çağrı merkezi otomasyonu
  • Eğitim: Telaffuz koçluğu, interaktif dil pratiği, sesli ders içerikleri
  • İçerik üretimi: Sesli kitap ve podcast üretimi, video seslendirme, dublaj
  • Erişilebilirlik: İşitme engelliler için gerçek zamanlı altyazı, görme engelliler için sesli betimleme

OpenAI.fm Alternatifleri: ElevenLabs Karşılaştırması

OpenAI.fm tek seçenek değil. En çok merak edilen karşılaştırma OpenAI.fm vs ElevenLabs:

  • OpenAI.fm: Ücretsiz denenir, “vibe” talimatıyla konuşma tarzını serbest metinle yönlendirmek çok güçlü. Ancak ses klonlama (kendi sesinizi kopyalama) sunmaz, sesler önceden tanımlıdır.
  • ElevenLabs: Ses klonlama ve çok geniş ses kütüphanesinde lider, ama ücretsiz kotası sınırlı. Duygu kontrolü OpenAI’ın talimat sistemi kadar esnek değil.
  • Google / Azure TTS: Kurumsal ölçekleme ve dil çeşitliliğinde güçlü, ama tarayıcıdan anında deneme kolaylığı yok.

Kısaca: hızlı deneme ve talimatla tarz kontrolü istiyorsanız OpenAI.fm, kendi sesinizi klonlamak istiyorsanız ElevenLabs öne çıkar.

OpenAI.fm Çalışmıyor mu? Sık Karşılaşılan Sorunlar

“OpenAI.fm ses üretmiyor” veya “error generating audio” hatası alıyorsanız:

  • Çok uzun metin: Girdiğiniz metni kısaltın; platform çok uzun metinlerde hata verebilir.
  • Yoğunluk / rate limit: Kısa süre bekleyip tekrar deneyin, aynı anda çok istek gönderirseniz geçici olarak sınırlanabilir.
  • Tarayıcı engeli: Reklam engelleyici veya katı gizlilik eklentileri ses oynatmayı bloklayabilir; farklı tarayıcıda deneyin.
  • Bağlantı: Ses üretimi bulutta yapıldığı için internet bağlantınızın stabil olması gerekir.

Site tamamen kapandı sanmayın; OpenAI.fm bir demo platformu olduğu için kısa bakım pencereleri olabilir, genelde kısa sürede geri gelir.

Sıkça Sorulan Sorular

OpenAI.fm nedir?

OpenAI.fm, OpenAI’ın metin seslendirme (text-to-speech) modeli GPT-4o-mini-tts’i herkesin tarayıcıdan ücretsiz deneyebildiği interaktif bir platformdur. Yazdığınız metni seçtiğiniz ses karakteriyle ve verdiğiniz konuşma tarzı talimatıyla seslendirir.

OpenAI.fm nasıl kullanılır?

openai.fm adresine girin, bir ses karakteri seçin, metninizi yazın, “Vibe” alanına konuşma tarzı talimatı ekleyin ve Generate’e basın. Üretilen sesi dinleyip indirebilirsiniz. Üyelik veya kurulum gerekmez.

OpenAI.fm uygulaması var mı, APK indirilir mi?

Hayır, OpenAI.fm bir mobil uygulama değil, tarayıcıdan çalışan bir web platformudur. “OpenAI.fm apk” veya “indir” şeklinde çıkan sonuçlar resmi değildir; güvenli kullanım için doğrudan openai.fm adresini ziyaret edin. Telefondan da tarayıcıyla açabilirsiniz.

OpenAI.fm en iyi ses hangisi, kadın sesi var mı?

Zevke göre değişir; podcast anlatımı için Ash ve Sage, canlı ve parlak bir kadın tınısı için Nova ve Shimmer sık tercih edilir. Kurumsal projelerde ise Realtime API’deki Marin (kadın) ve Cedar (erkek) en doğal seçenekler.

OpenAI.fm ücretsiz mi?

Evet, openai.fm üzerindeki deneme kullanımı ücretsizdir ve üyelik gerektirmez. Aynı modelleri kendi uygulamanızda API üzerinden kullanmak ise dakika başına yaklaşık 1.5 cent (gpt-4o-mini-tts) gibi ücretlere tabidir.

OpenAI.fm’de hangi sesler var?

Alloy, Ash, Ballad, Coral, Echo, Fable, Onyx, Nova, Sage, Shimmer ve Verse olmak üzere 11 hazır ses karakteri bulunur. Ayrıca “Vibe” alanına yazacağınız serbest talimatlarla her sesin tonunu, hızını, duygusunu ve karakterini değiştirebilirsiniz. En yeni Cedar ve Marin sesleri ise yalnızca Realtime API’de sunuluyor.

OpenAI.fm Türkçe destekliyor mu?

Evet, Türkçe metinleri seslendirebilir. Konuşma tanıma tarafında da GPT-4o-transcribe modeli Türkçede Whisper’dan belirgin şekilde düşük hata oranına sahiptir (FLEURS testinde 0.085 WER).

OpenAI.fm ile oluşturduğum sesleri kullanabilir miyim?

Oluşturduğunuz sesleri indirip projelerinizde kullanabilirsiniz. OpenAI, sentetik seslerin gerçek kişileri taklit etmemesi için modelleri önceden tanımlı yapay seslerle sınırlandırıyor; bu kurala uygun kullanım sizin sorumluluğunuzda.

Sonuç

OpenAI.fm, “yapay zekaya istediğim tonda konuşturabilir miyim?” sorusunun eğlenceli ve ücretsiz yanıtı. Arkasındaki GPT-4o-mini-tts ve GPT-4o-transcribe modelleri hem hobi projeleri hem de üretim seviyesi sesli uygulamalar için ciddi bir altyapı sunuyor.

Denemek için openai.fm adresine göz atabilir, geliştirme için OpenAI API dokümantasyonuna bakabilirsiniz.

Siz OpenAI.fm’i denediniz mi? En yaratıcı ses talimatınızı yorumlarda paylaşın! 👇🏻

Yapay Zeka Tarafından Oluşturulan İçerik Uyarısı
Bu blog tamamen yapay zeka tarafından oluşturulmuştur. Yapay zeka içerik oluşturmaya yardımcı olsa da, hala hatalar veya önyargılar içerebilir. Kritik detayları kullanmadan önce doğrulayın.