志工聽標

請你一起來,幫忙模型聽懂非典型語音

VocaLink 的使命,是為非典型語音者建起一座和世界溝通的橋樑。我們蒐集他們的聲音,為每一個人訓練專屬的聲音翻譯系統——也就是個人化語音辨識模型——讓他們的聲音,終於能被世界聽懂。

但其實這背後有很多事情要做。其中最耗心力的,就是確認每一段錄音,都真的是依照字卡朗讀。背景雜訊太多、念錯字卡、太早按下停止鍵……這些情況都會破壞我們蒐集到的資料,進而影響模型的訓練。

你可以想像,模型就像一個學生:如果我們給了錯誤的資訊,它自然會學錯、學不好。

1. 把聲音留下來

蠟筆塗鴉:孩子和大人留下聲音

孩子對著字卡說話。這段聲音得來不易。

2. 志工聽標

蠟筆塗鴉:志工戴耳機聽字卡

你戴上耳機,看著同一張字卡,聽聽看有沒有對得上。

3. 對得上,就能被聽懂

蠟筆塗鴉:兩個人中間有一顆愛心

正確的錄音會走進模型裡。教材對了,它才學得起來。

4. 差很多,就再試一次

蠟筆塗鴉:再試一次

太早停、雜音太大,就標出來。請他再錄,不讓模型學錯。

一條錄音,怎麼變成能被聽懂的聲音

因此每一條錄音,都是 VocaLink 團隊一條一條聽過的。我們知道每位非典型語音者的聲音得來不易,所以格外珍惜,確保每一個人的聲音,都被完整、正確地收錄。

隨著 VocaLink 服務的人數越來越多,我們在人力有限的情況下,越來越難負荷這麼大量的錄音檢視。但我們不想犧牲錄音品質,所以決定向大家求助:請你們一起來幫忙聽這些錄音檔。

蠟筆塗鴉:一個人戴耳機,花五分鐘聽錄音

每天只要

5 分鐘

泡一杯茶的時間,就能幫上忙。

蠟筆塗鴉:一張張聲音小卡

幫孩子與朋友

20 個音檔

一張一張聽過,模型才學得更準。

只要你願意每天花五分鐘,檢視二十個音檔,你就幫助了許多非典型語音的孩子與朋友,讓他們的模型更精準。你不需要專業背景,只需要判斷聽到的聲音和字卡是否有明顯差異:例如錄音太早被截斷、背景聲音太大,或是錄到了別的聲音,像是電視、喇叭。幫我們找出需要重錄的句子,你就已經做了一件很重要的事。

這份工作是無償的,但善念是無限的。請你和 VocaLink 一起,幫助世界聽懂他們的聲音。

如果你還不認識 VocaLink,或想知道我們在做什麼,歡迎來這裡找我們。