10/09/2026 01:35
環球動態|Anthropic研究員指人工智能有逾10%機率滅絕人類
人工智能安全研究機構Anthropic內部風波持續發酵,該公司安全研究員Jacob Coxon於周二(8日)宣布辭職,並公開指責Anthropic及OpenAI在開發超級智能系統時「將人類生命當作賭注」。其同事Evan Hubinger更直言,AI在未來十年內導致人類滅絕的機率超過10%。
Coxon在社交平台X發文稱,AI實驗室正全速推進具備自我改進能力的超級智能系統,但對齊控制(alignment)問題仍未解決。他警告這些系統將具備「突破任何網絡防護、一夜顛覆所有領域並獲取實質權力」的能力,強調「開發者真心相信AI可能在2030年前殺死全人類」。
Anthropic在6月發表的技術報告已承認,完全遞歸自我改進技術可能加劇人類對AI系統的失控風險。若AI能自主開發後繼系統,現行監控及安全措施將面臨重大挑戰。Hubinger回應Coxon時坦言,公司目前既無解決超級智能對齊問題的計劃,亦未取得實質進展。
特斯拉(US.TSLA)行政總裁馬斯克近年多次警告AI威脅,學術界亦持續關注企業對AI系統的失控風險。今年7月OpenAI模型失控入侵開源平台Hugging Face事件,更被視為AI威脅的預警信號。Coxon認為此類事件促使美國實驗室加強協調,但警告全球AI軍備競賽已難避免,或需採取「暫停提升模型能力」等激進措施。
《經濟通通訊社10日專訊》














