DeepSeek(深度求索)近日啟動了新架構「V4.1 Flash」模型的內部測試。這款測試版主打圖像與文字同步處理的「多模態」功能,並強調回應速度快、成本效益高。
根據Hacker News上流傳的公告,現有API的「base_url」維持不變,開發者只要將模型名稱設定為「deepseek-v4.1-flash-expires-on-0910」,即可呼叫這款測試模型。不過每個帳號的同時請求數量上限為20個。
值得留意的是,測試版目前的收費與既有的「deepseek-v4-flash」相同。換句話說,官方所提到的「成本效益」,並不代表API價格已經立即調降。
V4.1 Flash支援圖像與文字並用的多模態功能,也就是能在同一個模型中同時處理文字、圖片等多種類型的資料。DeepSeek此前已在官方API文件中新增支援圖像輸入的視覺模型,這次的V4.1 Flash可以視為V4系列多模態擴展的延續。
維持原有API位址、只更換模型名稱的做法,代表開發者不需大幅調整原本的呼叫架構就能先行測試。不過,模型名稱中帶有「0910」字樣,顯示這仍是內部測試版本,加上同時請求數量被限制在20個,目前的條件還不能等同於正式服務。
DeepSeek官方文件說明,7月31日轉為公開測試版的V4 Flash,在維持與先前V4 Flash預覽版相同模型結構與規模的前提下,經過重新訓練而成。這次V4.1 Flash則標榜採用全新架構,實際效能與既有版本相比究竟有多少差異,還得等官方公布基準測試(Benchmark)結果才能比較。
V4 Flash支援100萬個Token的上下文長度,並具備JSON輸出、工具呼叫(Tool Calling)與回應API等功能。V4系列模型的設計目的,是讓開發者能同時運用大規模文本處理與外部工具串接的能力。
這次的內部測試,被解讀為DeepSeek正從以文字為主的API,逐步擴大到涵蓋圖像輸入的模型陣容。不過,官方這次公告中並未提供新模型具體的效能數據,也沒有說明相較舊版模型究竟提升了多少。
目前DeepSeek尚未公布V4.1 Flash是否會正式上線、最終定價、提供期間,以及與既有模型的效能比較結果。現階段可以確認的條件,僅限於內測版本的呼叫方式、多模態支援、與既有V4 Flash相同的收費,以及每個帳號20個的同時請求上限。
留言 0