OpenAI宣布延攬曾主導「人類反饋強化學習」(RLHF)研究的保羅・克里斯蒂亞諾(Paul Christiano)加入OpenAI基金會董事會,往後他將以無投票權觀察員身分列席OpenAI集團董事會。OpenAI於9日公告中證實這項人事安排。
OpenAI表示,克里斯蒂亞諾同時將加入基金會董事會轄下的「安全與保障委員會」。他自2017年至2021年在OpenAI帶領對齊(alignment)研究團隊,其後創立「校準研究中心」(Alignment Research Center),持續鑽研如何讓人工智慧系統的行為與人類價值一致。
克里斯蒂亞諾9日在社群媒體發文示警,「如果在對齊技術沒有更大進展前就打造出超智慧,我認為人類很可能會永久失去控制權」,他進一步表示一旦真的失控,「多數人恐怕都會因此喪命」。這番發言點出AI安全圈長期以來最深的疑慮——技術演進若跑得比風險控管還快,後果恐難以挽回。
此次人事案顯示,OpenAI在持續推進前沿模型研發的同時,也在董事會層級加重外部安全監督的份量。克里斯蒂亞諾在安全與保障委員會將實際扮演何種角色、對公司後續的對齊策略是否帶來影響,仍值得持續關注。
留言 0