Sessizlik kaldırma ile dolgu kelime kaldırma aynı şey mi?

Hayır — ve bu karışıklık insanlara gerçek para ve gerçek zaman kaybettiriyor. Sessizlik kaldırma, seste neredeyse hiçbir şeyin olmadığı bölümleri bulur — cümleler arası boşluk, notlarınıza bakarkenki duraksama — ve keser; kayıt kısalır. Dolgu kelime kaldırma ise gerçekten çıkardığınız sesleri hedefler: konuşmayı şişiren "ıı", "şey", "hani" ve "yani"lar. Bir kayıt bu sorunların birinden, ikisinden ya da hiçbirinden mustarip olabilir ve birinin çözümü ötekine hiçbir şey yapmaz.

Genlik bazlı sessizlik kaldırma nasıl çalışır?

Sessizlik kaldırma sinyal matematiğidir. Araç dalga formunu tarar ve üç soru sorar: bir ânın sessiz sayılması için ne kadar sessiz olması gerekir (eşik), bu sessiz bölümün kesilmeye değmesi için ne kadar sürmesi gerekir (minimum sessizlik uzunluğu) ve her kesimin etrafında ne kadar nefes payı kalmalıdır (dolgu). Üç testi de geçemeyen her şey kaldırılır ve kalan konuşma yeniden birleştirilir. Tam ayar süreci, sesten ve videodan sessizlik kaldırma rehberimizde anlatılıyor.

Yalnızca ses düzeyini ölçtüğü için bu yaklaşım hızlı, belirlenimci ve dilden bağımsızdır. Söylediğiniz tek bir kelimeyi bile anlaması gerekmez — tamamen telefonunuzda, saniyeler içinde, hiçbir şey yüklemeden çalışabilmesinin nedeni de budur.

Yapay zekâlı dolgu kelime kaldırma nasıl çalışır?

Dolgu kelime kaldırma transkriptten yola çıkar. Araç kaydınızda konuşma tanıma çalıştırır, dolgu saydığı kelime ve yarım kelimeleri işaretler ve bu aralıkları sesten siler. Descript ve Cleanvoice bu yaklaşımın bilinen örnekleridir. Gerçekten faydalıdır — ama transkripsiyon doğruluğuna bağımlıdır, dile özgüdür ve konuşma modelleri ağır olduğundan bu araçlar sesinizi genellikle bulutta, abonelik ya da dakika başı planla işler.

Ayrıca bir ses ölçerin hiç karşılaşmayacağı yargı kararları içerir. "Yani" bir cümlede dolgu, sonrakinde gerçek bir kelimedir; bu yüzden transkript araçları ara sıra tutmak istediğiniz kelimeleri de işaretler — çoğunun tam da bu nedenle bir gözden geçirme adımı vardır.

Kaydınızın gerçekte hangi sorunu var?

Altmış saniye dinleyin ve teşhis koyun. Kayıt, cümleler arasında hiçbir şey olmadığı için yavaş geliyorsa — duruyor, düşünüyor, kahve yudumluyor, baştan alıyorsunuz — sorun sessizliktir ve genlik bazlı bir geçiş tempoyu dönüştürür. Kayıt akıyor ama her cümle "ıı" ile başlıyor ya da "yani"lere yaslanıyorsa sorun dolgu kelimelerdir ve hiçbir sessizlik kaldırıcı onlara dokunmaz; çünkü o sesler konuşmadır ve makul her eşiğin epey üzerinde kalırlar.

Kaba bir kalıp olarak podcast'ler, dersler ve ekran kayıtları daha çok boşluklardan; gergin ilk çekimler ve doğaçlama röportajlar daha çok dolgudan mustariptir. Uzun kayıtlarda çoğu zaman ikisi de bulunur.

SilenceRemover "ıı" ve "şey"leri siler mi?

Hayır — ve bir şey indirmeden önce bunu açıkça söylemek gerekir. [SilenceRemover](/) eşik bazlı bir sessizlik kesicisidir: sessiz boşlukları eşik, minimum sessizlik uzunluğu ve dolgu kullanarak algılar ve cihaz üzerinde, yüklemesiz ve hesapsız kaldırır. Sesinizi yazıya dökmez ve dolgu kelimeleri kaldırmaz. Bir "ıı", sizin çıkardığınız bir sestir; ses düzeyi dedektörü için sessizlik değil konuşmadır. Asıl sorununuz sözel tikler ise, bunun yerine — ya da buna ek olarak — transkript tabanlı bir araç istersiniz.

Takas ters yönde de işler: transkript araçları daha ağır, bulut tabanlı ve abonelik fiyatlıdır; kaydınızdaki tek kusur ölü havaysa bu epey fazla makine demektir.

İkisini birlikte kullanabilir misiniz?

Evet; cilalı uzun formatlı ses için bu birleşim yaygındır. Önce transkript tabanlı geçişi çalıştırın: dolgu kelimeleri bunun için yapılmış bir araçta kaldırın, önerdiği kesimleri gözden geçirin ve sonucu dışa aktarın. Sonra o dışa aktarımın üzerinde sessizlik kaldırmayı çalıştırıp kalanı sıkılaştırın. Bu sıranın daha iyi çalışmasının basit bir nedeni var — bir "ıı"yı silmek, çoğu zaman içinde oturduğu duraksamayı geride bırakır. Dolgu gider ama boşluk kalır ve onu kapatan, genlik geçişidir. Sırayı tersine çevirirseniz transkript aracı zaten sıkılaştırılmış ses üzerinde çalışır ve silmeleri, sonra yeniden onarmanız gereken küçük delikler açar.

Neden tek araç ikisini birden yapmıyor?

Bazı kurgu paketleri ikisini de sunar ama bunlar kaputun altında iki ayrı motordur ve fark, maliyet ile gizlilikte kendini gösterir. Genlik analizi, bir telefonda gizlilik içinde çalışacak kadar hafiftir. Transkript tabanlı kurgu ise bir konuşma modeli ister; bu da genellikle sesinizi yüklemek, işlemeyi beklemek ve hesaplama gücüne para ödemek demektir. İkisini paketlemek, yalnızca hafif yarıya ihtiyacınız olduğunda bile bulut fiyatı ödemek anlamına gelir — odaklı, cihaz üstü sessizlik araçlarının başlı başına bir kategori olarak var olmasının nedeni tam da budur.

Önce hangisini düzeltmelisiniz?

Yalnızca tek bir şeyi düzeltecekseniz sessizliği düzeltin — harcanan dakika başına kazanç genellikle daha büyüktür; tek otomatik geçişte gerçek süreden keser. Dolgu kelimelere çoğu zaman bir konuşma alışkanlığı olarak yaklaşmak daha iyidir: "ıı" demek yerine yavaşlayıp durmak, gelecekteki her kaydı bedavaya düzeltir ve geride bıraktığı duraksama, bir sessizlik kaldırıcının temizlediği şeyin ta kendisidir. Üçüncü bir sorunu da zihninizde ayrı tutun — sabit arka plan hışırtısı ya da uğultusu ne sessizliktir ne dolgu; o sınır sessizlik kaldırma ile gürültü azaltma farkında ele alınıyor.