B.AI宣布將阿里巴巴(Alibaba)旗下通義千問(Qwen)最新模型千問3.8 Flash(Qwen3.8-Flash)上架平台,並在開發者專用的API官方社群開放免費呼叫,開發者不需額外付費即可直接測試這款新模型。
根據中國科技媒體TechFlow的報導,B.AI於27日將千問3.8 Flash上架平台,並在API官方社群中提供全額免費呼叫服務。
千問3.8 Flash是以千問3.8 Flash Next(Qwen3.8-Flash-Next)為基礎推出的正式生產版本。千問官方部落格指出,千問3.8 Flash Next屬於千問4(Qwen4)架構的早期預覽版本。
官方介紹指出,這款模型採用「多模態混合專家(MoE)」架構。混合專家模型的特色在於:並非每次都動用全部參數,而是依任務需求只啟動部分參數,藉此調整運算成本與回應速度。
模型規模方面,主模型參數達1250億個,另外還有510億個N-gram嵌入參數,每個token實際啟用的參數量則為60億個。
基礎上下文長度為26萬2144個token,官方表示,搭配YaRN技術後最長可延伸至100萬token。
技術架構上,模型混合採用「閘控差量網路」(Gated DeltaNet,GDN)與「千問稀疏注意力」(Qwen Sparse Attention,QSA)兩種注意力機制。千問說明,GDN負責壓縮長歷史紀錄,QSA則以精細區塊為單位挑選重要上下文。
B.AI列舉的應用場景包括程式碼輔助、代理工作流程(agent workflow)以及文件分析等多模態任務。
此次上架是在千問先前公布正式版API定價之後的又一項流通進展,當時官方開出的價格為每百萬輸入token 0.16美元、每百萬輸出token 0.47美元。
千問3.8 Flash的免費呼叫僅限透過B.AI API官方社群提供,實際的免費範圍與截止條件,仍須以正式使用前平台公告及帳單頁面顯示的資訊為準。
這並非B.AI首次開放模型免費使用。本站先前也報導過,B.AI曾開放DeepSeek V4 Flash免費存取的案例。
評論:AI基礎設施平台整合外部模型後,開發者能省去分別串接各模型API與計費系統的麻煩,但實際導入服務時,仍須留意平台本身的速率限制、計費標準與資料處理條件等變數。
對台灣開發者而言,比起「是否免費」,更重要的是先確認提供範圍。B.AI目前的免費呼叫僅開放給API官方社群成員使用。
留言 0