Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

GLM-5.3-Flash進駐OpenRouter:Near AI Cloud提供百萬Token上下文模型

安全運算環境中的GPU設備與筆記型電腦 / TokenPost.ai

Near AI Cloud已登錄為OpenRouter供應商,提供Z.ai的GLM-5.3-Flash模型。該模型支援最高100萬Token上下文,以及文字、圖片與影片輸入。

OpenRouter供應商名單將Near AI列為採用「Zero retention」政策、且不會將提示詞用於模型訓練的供應商。目前頁面列出1個可用模型,OpenRouter官方供應商名單也會統計各供應商的處理量。

此次整合透過OpenRouter的「near-ai」路徑提供模型。模型由Z.ai開發,Near AI Cloud則負責提供機密推理環境的基礎設施。Crypto Briefing報導了這項消息。

Z.ai於8月26日發布GLM-5.3-Flash。根據官方公告,該模型總計採用3200億個參數,其中180億個參數會被啟用,並結合稀疏注意力與線性注意力,以處理長上下文。

Near AI Cloud主打的差異化優勢不在模型效能,而在執行環境。公司表示,服務利用英特爾TDX虛擬機與輝達(NVDA) GPU,在可信執行環境(TEE)內完成推理,並透過硬體簽章提供證明,驗證請求是否在該環境中處理。

Near AI官方網站指出,工作會在阻絕外部存取的環境中執行,主機作業系統、GPU營運商與Near AI都無法查看執行內容。網站也說明,每項請求都會返回可由第三方驗證的硬體簽章證明。

完成OpenRouter登錄後,開發者不必另外申請Near AI專用帳戶或使用專屬SDK,即可透過API呼叫模型。OpenRouter是一個路由平台,能以單一API連接多個模型與供應商,並支援按模型選擇或排除供應商。

不過,使用OpenRouter並不代表所有請求都會由Near AI Cloud處理。若採用自動路由,請求可能轉交給其他供應商,因此開發者需要確認是否固定或排除特定供應商。

OpenRouter供應商頁面上的「Zero retention」是Near AI供應商層級的政策資訊。所有經由OpenRouter傳送的請求是否都享有相同安全標準,仍可能取決於供應商選擇,以及帳戶和API設定。

Near AI官方網站與隱私文件說明,推理過程中的輸入與輸出會在硬體安全區域內處理,且不會將使用者內容用於模型訓練。不過,僅憑這些說明,無法斷定OpenRouter的路由、快取與錯誤處理流程也採用相同方式。

GLM-5.3-Flash的長上下文能力可用於一次處理長篇文件、程式碼與多步驟工作指令。實際速度與回應品質則會受到供應商基礎設施和請求設定影響。

Crypto Briefing列出的Near AI Cloud供應價格為每100萬個輸入Token 0.15美元(約203韓元),每100萬個輸出Token 0.50美元(約678韓元)。不過,這些價格是否與目前OpenRouter的付款頁面一致,仍需另行確認。

開發者社群一方面肯定長上下文與成本效率,另一方面也有人指出不同供應商之間存在速度、錯誤率和回應品質差異。Near論壇則將OpenRouter登錄視為擴大開發者分發網絡的案例,但也有意見認為仍需觀察實際採用情況與使用量指標。

這起案例延續了Near AI Cloud以OpenAI相容API與TEE隱私驗證吸引開發者的發展方向,也代表其既有API接入方式增加了OpenRouter這條外部分發通路。

目前沒有證據顯示,OpenRouter登錄將帶動尼爾協議(NEAR)的代幣需求或開發者採用增加。開發者仍應逐項確認是否指定「near-ai」供應商,以及是否啟用無保留設定。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1