跳至主要内容

選擇與下載語言模型

目前,該外掛程式設計為支援單一語言模型,需事先在編輯器中選取,以便與專案一起打包和使用。請依照以下步驟選取、下載並暫存特定的語言模型:

  1. 從可用的選項中選擇所需的模型。此外掛程式開箱即用地支援以下模型:

    標準模型:

    • Tiny
    • Base
    • Small
    • Medium
    • Large V1
    • Large V2
    • Large V3
    • Large V3 Turbo

    量化模型(縮小檔案大小):

    • Tiny Quantized (Q5_1) - 量化至 5 位元與 1 個小數點
    • Tiny Quantized (Q8_0) - 量化至 8 位元與 0 個小數點
    • Base Quantized (Q5_1) - 量化至 5 位元與 1 個小數點
    • Small Quantized (Q5_1) - 量化至 5 位元與 1 個小數點
    • Medium Quantized (Q5_0) - 量化至 5 位元與 0 個小數點
    • Large V2 Quantized (Q5_0) - 量化至 5 位元與 0 個小數點
    • Large V3 Quantized (Q5_0) - 量化至 5 位元與 0 個小數點
    • Large V3 Turbo Quantized (Q5_0) - 量化至 5 位元與 0 個小數點

    蒸餾模型:

    • Distil Small - Small 模型的蒸餾版本
    • Distil Medium - Medium 模型的蒸餾版本
    • Distil Large V2 - Large V2 模型的蒸餾版本
    • Distil Large V3 - Large V3 模型的蒸餾版本

自訂模型:

  • 自訂 - 指定自訂模型名稱和 URL,以從伺服器下載您自己的語言模型

每個模型(除了 Custom 之外)都可以配置為 多語系僅限英文

  1. 點擊設定語言模型按鈕,如果本機上尚未有所選的語言模型,它會提示您自動下載。

  2. 下載完成後,編輯器將生成一個語言模型資產,位於 "Plugins/RuntimeSpeechRecognizer/Content/LanguageModels/LanguageModel.uasset"。此語言模型資產將是隨您的專案打包的唯一語言模型資產。

您也可以點擊清除語言模型按鈕,移除任何本機下載的語言模型。

或者,您可以手動https://huggingface.co/ggerganov/whisper.cpp 下載語言模型,然後將它們放入 "Plugins/RuntimeSpeechRecognizer/Content" 資料夾中。

請注意,只有所選的語言模型會與您的專案一起打包。因此,您無需擔心其他模型,因為它們將在打包階段被排除。