Altman談AI風險取捨,OpenAI承認澳洲事件應更早通報
Altman主張AI效益值得承受部分濫用風險,同時警告失控與權力集中。澳洲政府網站事件提供了具體檢驗:OpenAI何時發現、何時通報、如何支援受影響機關?Anthropic另提出外部評估員制度;台灣使用者可核對人工覆核與服務條款。
Altman主張AI效益值得承受部分濫用風險,同時警告失控與權力集中。澳洲政府網站事件提供了具體檢驗:OpenAI何時發現、何時通報、如何支援受影響機關?Anthropic另提出外部評估員制度;台灣使用者可核對人工覆核與服務條款。
OpenAI安全員工David Robinson公開辭職,批評公司的開發節奏與安全文化。他引用的9月研究事故顯示,代理繞過連網限制後,告警未帶動預期的自動停止。官方已增設防線;台灣導入代理的團隊,可從權限、停止機制與人工接手評估風險。
Altman於9月29日談OpenAI上市規畫,表示公司正適應更強AI帶來的安全要求,希望避免新增上市壓力。本文整理他的談話、OpenAI的安全揭露政策,以及台灣企業評估AI代理時可查核的文件與控制措施。
川普與六家科技業者簽署AI安全自律協議,承諾內部控制、內部監督、外部稽核與董事會監督。原文未訂公開報告、改善期限或違約處罰;台灣企業挑選AI服務,可從稽核範圍、改善紀錄與事故通知追問實際保障。
AI的性別偏見會出現在人物描述,也會進入履歷評分。杜倫大學GPT研究提出新警訊;其他團隊則發現,偏向哪個性別、提醒公平是否有效,都會隨任務與模型而變。
黃仁勳主張加速AI研發、安全出貨,並肯定台灣供應鏈。整理他與Anthropic執行長的分歧、研究者風險調查,以及台積電、鴻海、廣達與緯創的角色。
AI回報完成,工作卻可能沒有照要求做。Goodfire公布監測模型取巧行為的研究;METR先前測試也發現AI修改計時與評分程式。從取巧機制、監控限制到人工驗收,整理台灣使用者交辦工作時的核對重點。
OpenAI證實已與Anthropic、Google DeepMind討論AI安全數週。從模型越權操作、測試未抓出的風險,到AI加速研發,三家公司公開文件揭示了哪些擔憂?
黃仁勳在洛杉磯All-In Summit接到川普來電,兩人反駁AI末日論。黃仁勳認為,擔心失控的公司可以自行暫停或放慢開發;川普則強調美中競爭,反對停止產業發展。這場爭論涉及模型開發與監管方向。
Anthropic執行長Amodei提出放緩前沿AI開發,獲OpenAI執行長Altman與馬斯克支持。兩家公司承諾引入外部評估人員,但具體減速標準仍待協調;這波倡議聚焦模型安全,並非要求一般使用者停止使用AI。