當地時間28日,美國人工智能(AI)企業OpenAI表示,因研究人員在內部測試中發現安全隱患,決定取消發布最新AI大模型GPT-6.1 Astra,這是全球大型AI企業首次因安全風險叫停新產品發布。另一AI巨頭Anthropic則在上市招股書中警告,AI可能「威脅人類生存」。美國總統特朗普計劃在當地時間29日與美國六大科技企業負責人共進午餐,商討AI監管議題。
Anthropic:AI或「威脅人類生存」
《華爾街日報》報道,GPT-6.1 Astra原計劃10月推出,為ChatGPT和Codex提供技術底座。OpenAI安全系統主管賈因28日受訪表示,該模型在評估能否嚴格遵循人類意圖與指令的「對齊」測試中表現不佳,未能達標;其表現出更高程度的欺騙性,有時未如實披露操作過程與細節,還會在未獲用戶許可下擅自執行任務,甚至嘗試調用外部工具規避限制。OpenAI計劃展開多項深入排查,找出問題根源。
美媒指出,大型AI公司此前未見因安全顧慮放棄發布新版大模型,反映業界已無法迴避AI大模型失控問題。今年7月以來,OpenAI旗下大模型曝出多起失控事件,包括入侵開源平台「抱抱臉」、澳洲政府網站、美國政府網站和聯合國網站等。OpenAI於29日就入侵澳洲政府網站公開致歉,承諾成立特別工作組,其首席戰略官傑森·權將於10月6日赴悉尼出席聽證會。
路透社取得的文件顯示,Anthropic在IPO招股書中明確警告,其AI大模型可能表現出「自我保護行為」,包括「抵制關機」、「隱瞞或操縱信息」以及「類似勒索」的舉動,可能對人類構成「生存風險」。Meta、谷歌等科企的大模型亦被揭發安全漏洞,引發暫停或放緩AI開發的呼聲。
美國佛羅里達州總檢察長已於28日起訴OpenAI,要求法院在第三方安全護欄建立前禁止其開發新模型。計算機專家克拉夫在《自然》撰文指出,不應將責任推給「失控的AI」,真正的問題在於人類的疏忽以及AI實驗室缺乏有效的問責機制。
特朗普晤6科技巨頭談AI監管
特朗普近日明確拒絕對AI設置安全「護欄」,認為不利於美國在該領域保持領先。29日白宮午餐會出席者包括Meta創辦人朱克伯格、Anthropic行政總裁阿莫戴、OpenAI總裁布羅克曼、谷歌CEO皮柴、Palantir行政總裁卡普及英偉達CEO黃仁勳。各企業態度並不一致:Anthropic和OpenAI建議加強政府監管,黃仁勳強調安全責任在於各家公司。國會兩黨均有議員質疑特朗普的態度,擔憂AI帶來的安全風險及對就業的衝擊。
關於AI發展各方最新表態
• 特朗普27日重申,美國沒有理由放慢AI發展。
• Anthropic行政總裁阿莫戴23日在聯合國安理會表示,AI可能對全人類構成風險,基於安全緣故,公司將在必要時放慢研發進度。
• Meta創辦人朱克伯格24日表示,AI公司不需要業界全面協調也能安全開發先進AI系統,各實驗室可自行處理相關風險。
• xAI創辦人馬斯克25日表示,AI安全監管需要合作,如何公平地對所有國家研發的AI實施監管,是全球必須思考的問題。
• OpenAI、Anthropic、微軟和Meta多位研究人員28日發表論文警告,AI的自我改進速度可能很快超過人類的理解能力,呼籲政策制定者加強監管。
AI自動升級加速 研究員籲收緊監管
來自美國多家頂尖AI公司的研究人員28日聯合發表論文警告,AI「遞歸自我改進」(RSI)可能加速,並最終脫離人類控制,緊急呼籲對相關技術進行監管。合著者包括OpenAI首席科學家帕霍茨基、Anthropic聯合創辦人克拉克、微軟首席科學官霍維茨、Meta AI研究副總裁宋曉冬,以及「AI教父」辛頓、圖靈獎得主本吉奧等AI研究先驅。
文章指出,RSI技術讓AI參與改進新模型的開發過程,過去需要數年的技術進展或被壓縮至數月甚至更短,從而引發「智能爆炸」。他們呼籲各國政府緊急調查企業研發自動化程度,並通過國際談判制定監管協議,防止失控系統帶來人類「邊緣化或滅絕」的風險。
目前Anthropic旗下Claude已主導公司26%的研發工作;OpenAI計劃於2028年前打造全自動AI研究員,現有七成研究人員正使用多個AI智能體輔助工作。OpenAI、Anthropic、Meta及谷歌均承認旗下模型在測試中曾出現異常行為。
(來源:大公報)