嗶哩嗶哩(Bilibili)開源發布支援150種語言的多語言翻譯模型系列「Index-Translate」,除文字翻譯外,也支援翻譯指令、字幕與語音轉換、音節數控制及長篇文件翻譯。
嗶哩嗶哩 Index LLM 團隊於30日公布 Index-Translate。該模型以 Qwen3.5 為基礎開發,並提供2B、9B文字模型及35B-A3B預覽模型的權重。
模型權重與執行方式已載於官方儲存庫,同時提供從 Hugging Face 與 ModelScope 下載模型的途徑。
Index-Translate 除一般句子翻譯外,也能配合使用者指定的翻譯指令。使用者可要求保留特定術語,或指定文件格式、文體、句子結構與輸出長度,模型會將相關要求反映在翻譯結果中。
模型說明也列出網路迷因與社群用語翻譯功能,顯示其設計不僅處理文字內容,也能控制翻譯對象的表達方式與格式。
不同模型規模對應不同使用情境。2B模型被定位為可在相對輕量環境中執行的選項,9B模型則已應用於線上展示服務。
35B-A3B是只啟用全部參數中部分參數的預覽模型。由於仍處於預覽階段,各模型的效能與實際適用範圍可能因使用環境而異。
除文字模型外,團隊也公開語音與配音相關模型系列。「Index-Echo S2TT」會先將語音轉為字幕,再進行翻譯;「Index-Echo S2ST」則會將語音轉換為另一種語言的語音。
「Index-Homura」是配合目標語言音節數進行翻譯的模型,主要針對字幕或配音等重視譯文長度與發音時間的工作。
團隊另推出「Index-NativeLong」,可維持多個段落的上下文並翻譯整份文件,使用情境從短句翻譯延伸至長篇文件的脈絡處理。
Index-Translate 將文字翻譯與翻譯指令整合在同一模型系列中,並進一步擴展至語音、配音與長篇文件翻譯。此次開源發布後,開發者可直接查看模型權重與執行方式。
Hugging Face 是開發者分享 AI 模型與資料的平台,也可作為觀察開源模型發布與使用者關注度的管道,類似本刊先前報導的 Qwen 系列模型案例。
官方儲存庫目前也提供推論指南、瀏覽器擴充功能及影片配音流程相關資料。35B-A3B模型現階段仍以預覽版提供,並同步公開各模型的評估資料與技術報告。
留言 0