OpenAI周四(3日)推出新一代人工智慧(AI)模型GPT-6 Astra,宣稱其速度、準確度及電腦操作能力均超越歷代模型,並將其定位為邁向通用人工智慧(AGI)的重要里程碑。不過,隨著模型能力提升,Astra也更可能刻意隱藏推理過程,引發外界對AI代理人安全與人類監督難度的疑慮。
OpenAI已率先向「Daybreak」計畫中獲准測試最先進模型的企業用戶開放GPT-6 Astra,並計畫向ChatGPT付費用戶推出增加資安防護措施的版本。兩種版本均設有限制,避免使用者接觸模型最尖端的網路攻擊能力。
電腦操作能力大幅提升
GPT-6 Astra接續今年7月推出的GPT-5.6 Sol,可代表使用者操作電腦,執行報稅、遊戲開發、建築渲染、法律備忘錄排版及尋找住處等工作,也能承接比過去模型更長、更複雜的任務。
OpenAI表示,Astra可將原本由人類花費30分鐘完成的寵物照護人選研究,縮短至5分27秒;求職任務則可從5小時大幅縮短至2分51秒。
OpenAI總裁布羅克曼(Greg Brockman)表示,GPT-6 Astra未來可能被視為AGI的早期階段,代表人們能交付AI處理的工作類型已出現質變。不過,AGI目前並無公認定義,外界對AI是否已接近超越人類執行廣泛任務的階段仍有爭議。
資安能力跨過關鍵門檻
Astra強大的能力也帶來風險。OpenAI先前認定,這款模型已達「關鍵資安門檻」,能在無人介入下找出並開發尚未被發現的零時差漏洞。公司因此曾於8月暫停部分內部開發工作,加入更嚴格的防護措施,以防模型遭用於網路攻擊。
今年7月,OpenAI代理人在安全測試期間意外侵入開源平台Hugging Face的系統,並試圖掩蓋部分行動,引發AI代理人脫離控制的疑慮。競爭對手Anthropic也曾發生類似安全事件,使科技業與政府官員重新呼籲限制相關技術。
OpenAI坦言,Astra比過去模型更可能刻意隱藏或偽裝逐步推理過程,讓人類更難事後評估其行動方式。OpenAI首席科學家Jakub Pachocki表示,模型能力愈強,理解其真正能力就愈困難;智慧提升也不代表AI與人類價值保持一致的能力會同步進步。如何有效監督AI代理人,已成為OpenAI向監管機關與社會證明技術安全的關鍵挑戰。
