Meta($META)將全新影片生成模型「Muse Video」以搶先亮相的方式公開,而非正式推出。公司表示未來將提供給創作者與Meta AI使用,但尚未公布上線時間、價格與API開放與否。
根據Meta官方部落格,於7月7日同時發布Muse Image(繆思影像)與Muse Video(繆思影片)。Muse Image已導入Meta AI應用程式、meta.ai網站、美國地區Instagram限時動態,以及部分國家的WhatsApp;Muse Video則被列為同一模型系列的後續公開項目。
Muse Video由Meta超級智慧實驗室(Meta Superintelligence Labs)開發,屬於該實驗室首個媒體生成模型系列。Meta說明,Muse Image與Muse Video共用相同的預訓練基礎。
這款模型是具備基礎音訊功能的影片生成模型。Meta表示,Muse Video在提示詞還原度、畫面品質與時間一致性上都具備競爭力。
官方也一併公布效能數據。截至發表當下,Muse Video在文字轉影片類別的Arena人類偏好Elo排行榜上名列第3;Muse Image則在文字轉圖片、單張圖片編輯、多張圖片編輯三個項目中,皆排名第2。
不過Meta也坦承技術限制。公司指出,音訊與畫面的同步、快速動作的物理真實呈現,都還需要進一步改善。
這次發表與Meta近來的策略方向一致,也就是不讓生成式AI(詞)停留在獨立實驗技術階段,而是直接整合進自家應用程式。Meta先前已公開Muse Spark與Meta Model API,持續擴大代理型AI與開發者用模型的存取範圍。
Meta說明,Muse Image具備「自我改善」功能,能運用搜尋與程式編輯工具,自行修正生成結果。這被視為Meta想把圖片生成模型,從單純的輸出工具,轉型為能在自家AI產品線中運作的生成式系統。
路透社(Reuters)報導,Meta隨著Muse Image上線,正將生成式AI工具擴大到旗下各項應用程式。Muse Image支援超過30種Instagram限時動態專用AI特效,部分國家的WhatsApp也能在與Meta AI的對話中直接生成圖片。
然而,同一系列推出的Muse Image很快就捲入隱私爭議。路透社指出,Meta曾開放使用者利用公開的Instagram帳號內容來生成圖片,但這項功能上線僅幾天就被緊急下架。
Meta回應表示:「我們原本希望讓使用者能自行決定公開內容是否會被這種方式引用」,並補充「我們收到這項功能未達預期的意見回饋,因此已經停止提供」。外界解讀,這項功能的設計未能充分處理使用者同意與控制權的問題。
代表演員與媒體從業人員的工會組織SAG-AFTRA(美國演員工會-美國電視廣播藝人聯合會)也提出質疑。該工會表示,使用Instagram用戶的圖像應取得明確且顯著的選擇同意,並在Meta下架該功能後,以避免非自願數位複製風險為由,公開表達歡迎。
評論:影片生成AI一旦普及,同意與著作權爭議恐怕會比圖片領域更複雜,因為人物的臉部、聲音與動作都可能同時出現在生成內容中,數位複製爭議的風險也隨之升高。
Meta目前已在Muse Image導入名為「Content Seal」的隱形浮水印技術,用來識別圖片是否由AI生成,並表示未來計畫將這項技術擴展到影片。
不過,這項技術實際應用在影片上的效果與驗證強度,目前僅止於官方說法,尚未獲得證實。當Muse Video真正對外開放服務時,除了生成品質之外,使用者同意、著作權,以及生成內容標示方式,預料都將成為外界檢視的重點。
留言 0