Ses kaydını yazıya çevirme
Türkçe kayıtlar ve videolar, ses cihazınızdan çıkmadan döküm ve altyazı olarak.
Dosyaları buraya bırakın
veya cihazınızdan seçmek için tıklayınKabul edilen: MP3, M4A, AAC, WAV, OGG, OGA, OPUS, FLAC, WEBA, MP4, M4V, WEBM, MOV, MKV
Her işlemde en fazla 3 dosyaDosya başına en fazla 20 MBGünde 10 işlemPro ile sınırları kaldırın✓ Çevrimdışı çalışır
Dosyalarınız cihazınızda kalır
Bu araç tamamen tarayıcınızda çalışır. Hiçbir şey yüklenmez, hiçbir şey saklanmaz; hatta başlamadan önce internet bağlantınızı kapatabilirsiniz.
Nasıl çalışır
- Bir ses ya da video dosyası ekleyin: MP3, M4A, WAV, MP4, OPUS ve tarayıcının çalabildiği hemen her şey.
- Dil Türkçe olarak ayarlı. Dökümde zaman damgası istiyorsanız “Her satırın başına zamanı yaz” kutusunu işaretleyin.
- Birden çok kişi konuşuyorsa “Konuşmacıları ayır”ı işaretleyin; her satır Konuşmacı 1, Konuşmacı 2 diye başlar.
- Yazıya çevir’e basın. İlk seferde ses modeli (yaklaşık 250 MB) bir kez iner; sonra hemen başlar.
- Dökümü kopyalayın ya da SRT altyazıyla birlikte metin dosyası olarak indirin.
Sık sorulan sorular
- Ne kadar doğru?
- Whisper small (OpenAI, Apache 2.0) kullanır. Net okunmuş Türkçede (FLEURS) modelin yayımlanmış sonucu yaklaşık her altı kelimede bir hatadır; haber ve sohbet yayınlarından alınmış kayıtlarla yaptığımız testte kelimelerin yaklaşık üçte biri hatalı çıktı. Türkçede tek bir yanlış ek bütün kelimeyi hatalı saydırdığı için metin, bu oranların düşündürdüğünden daha okunaklıdır. Gürültü, ağız, üst üste konuşma, terimler ve az bilinen adlar hatayı artırır.
- Noktalama işareti koyar mı?
- Koyar. Whisper büyük harfleri, noktaları ve virgülleri kendisi yazar. Satırlar yine de konuşmacının durduğu yerde başlar ve altyazılar aynı yerlerden bölünür.
- İndirme neden bu kadar büyük?
- Çünkü daha küçük bir model Türkçe için yetmedi: İngilizceye yeten Whisper base, aynı Türkçe yayın kayıtlarında sık sık aynı cümleyi tekrar edip takıldı. Yaklaşık 250 MB bir kez iner ve tarayıcıda kalır.
- Kimin konuştuğunu ayırt eder mi?
- “Konuşmacıları ayır”ı işaretlerseniz her satır Konuşmacı 1, Konuşmacı 2 diye başlar. Kayıt bunun için ikinci kez, kelimeleri değil sesleri dinleyen iki ayrı modelle okunur: ilk seferde 34 MB daha iner ve bekleme süresi aşağı yukarı ikiye katlanır. Kayıtta kimin kim olduğunu söyleyen bir şey olmadığı için ad yerine numara yazılır. Net kaydedilmiş iki ses doğru çıkar; toplantı odasında tek mikrofon, birbirine benzeyen sesler ve uzun süre üst üste konuşma zayıf noktalarıdır.
- Kaydım yükleniyor mu?
- Hayır. Tanıma bu sayfada, kendi cihazınızda yapılır; bu yüzden toplantı, röportaj ve dışarı çıkmaması gereken her kayıt için uygundur. Model bir kez indikten sonra çevrimdışı da çalışır.
- Ne kadar sürer?
- Bilgisayarda kaydın yaklaşık yarısı kadar: bir saatlik kayıt için yarım saat. Telefonlar daha yavaştır ve uzun bir kayıtta bellek yetmeyebilir; önce parçalara bölün.
- Hangi diller?
- Dokuz: Türkçe, İngilizce, Almanca, Fransızca, İspanyolca, Portekizce, İtalyanca, Korece ve Japonca. Kaydın dilini seçin; model dili tahmin etmez, ona söylenir, böylece Türkçe bir kayıt çevrilmiş olarak çıkmaz.
Belirli bir kullanım için
İlgili araçlar
❝ Toplantı kaydından tutanak Kim, ne zaman, ne dedi – ve bundan ne karar verdiğiniz için hazır başlıklar. ▭ Videoya altyazı ekleme Görüntüye gömülü bir SRT dosyası; sözler her ekranda görünür. ≋ Ses gürültü giderme Vantilatör, cızırtı ve uğultu, sesin altından temizlenir. ♪ Video’dan MP3’e Videonuzun sesi, cihazınızda MP3’e dönüşür.