Nouplo

Ses kaydını yazıya çevirme

Türkçe kayıtlar ve videolar, ses cihazınızdan çıkmadan döküm ve altyazı olarak.

Dosyaları buraya bırakın

veya cihazınızdan seçmek için tıklayınKabul edilen: MP3, M4A, AAC, WAV, OGG, OGA, OPUS, FLAC, WEBA, MP4, M4V, WEBM, MOV, MKV

Her işlemde en fazla 3 dosyaDosya başına en fazla 20 MBGünde 10 işlemPro ile sınırları kaldırın✓ Çevrimdışı çalışır

Dosyalarınız cihazınızda kalır

Bu araç tamamen tarayıcınızda çalışır. Hiçbir şey yüklenmez, hiçbir şey saklanmaz; hatta başlamadan önce internet bağlantınızı kapatabilirsiniz.

Nasıl çalışır

  1. Bir ses ya da video dosyası ekleyin: MP3, M4A, WAV, MP4, OPUS ve tarayıcının çalabildiği hemen her şey.
  2. Dil Türkçe olarak ayarlı. Dökümde zaman damgası istiyorsanız “Her satırın başına zamanı yaz” kutusunu işaretleyin.
  3. Birden çok kişi konuşuyorsa “Konuşmacıları ayır”ı işaretleyin; her satır Konuşmacı 1, Konuşmacı 2 diye başlar.
  4. Yazıya çevir’e basın. İlk seferde ses modeli (yaklaşık 250 MB) bir kez iner; sonra hemen başlar.
  5. Dökümü kopyalayın ya da SRT altyazıyla birlikte metin dosyası olarak indirin.

Sık sorulan sorular

Ne kadar doğru?
Whisper small (OpenAI, Apache 2.0) kullanır. Net okunmuş Türkçede (FLEURS) modelin yayımlanmış sonucu yaklaşık her altı kelimede bir hatadır; haber ve sohbet yayınlarından alınmış kayıtlarla yaptığımız testte kelimelerin yaklaşık üçte biri hatalı çıktı. Türkçede tek bir yanlış ek bütün kelimeyi hatalı saydırdığı için metin, bu oranların düşündürdüğünden daha okunaklıdır. Gürültü, ağız, üst üste konuşma, terimler ve az bilinen adlar hatayı artırır.
Noktalama işareti koyar mı?
Koyar. Whisper büyük harfleri, noktaları ve virgülleri kendisi yazar. Satırlar yine de konuşmacının durduğu yerde başlar ve altyazılar aynı yerlerden bölünür.
İndirme neden bu kadar büyük?
Çünkü daha küçük bir model Türkçe için yetmedi: İngilizceye yeten Whisper base, aynı Türkçe yayın kayıtlarında sık sık aynı cümleyi tekrar edip takıldı. Yaklaşık 250 MB bir kez iner ve tarayıcıda kalır.
Kimin konuştuğunu ayırt eder mi?
“Konuşmacıları ayır”ı işaretlerseniz her satır Konuşmacı 1, Konuşmacı 2 diye başlar. Kayıt bunun için ikinci kez, kelimeleri değil sesleri dinleyen iki ayrı modelle okunur: ilk seferde 34 MB daha iner ve bekleme süresi aşağı yukarı ikiye katlanır. Kayıtta kimin kim olduğunu söyleyen bir şey olmadığı için ad yerine numara yazılır. Net kaydedilmiş iki ses doğru çıkar; toplantı odasında tek mikrofon, birbirine benzeyen sesler ve uzun süre üst üste konuşma zayıf noktalarıdır.
Kaydım yükleniyor mu?
Hayır. Tanıma bu sayfada, kendi cihazınızda yapılır; bu yüzden toplantı, röportaj ve dışarı çıkmaması gereken her kayıt için uygundur. Model bir kez indikten sonra çevrimdışı da çalışır.
Ne kadar sürer?
Bilgisayarda kaydın yaklaşık yarısı kadar: bir saatlik kayıt için yarım saat. Telefonlar daha yavaştır ve uzun bir kayıtta bellek yetmeyebilir; önce parçalara bölün.
Hangi diller?
Dokuz: Türkçe, İngilizce, Almanca, Fransızca, İspanyolca, Portekizce, İtalyanca, Korece ve Japonca. Kaydın dilini seçin; model dili tahmin etmez, ona söylenir, böylece Türkçe bir kayıt çevrilmiş olarak çıkmaz.

Belirli bir kullanım için

İlgili araçlar