Gate 廣場“新星計劃”正式上線!
開啟加密創作之旅,瓜分月度 $10,000 獎勵!
參與資格:從未在 Gate 廣場發帖,或連續 7 天未發帖的創作者
立即報名:https://www.gate.com/questionnaire/7396
您將獲得:
💰 1,000 USDT 月度創作獎池 + 首帖 $50 倉位體驗券
🔥 半月度「爆款王」:Gate 50U 精美周邊
⭐ 月度前 10「新星英雄榜」+ 粉絲達標榜單 + 精選帖曝光扶持
加入 Gate 廣場,贏獎勵 ,拿流量,建立個人影響力!
詳情:https://www.gate.com/announcements/article/49672
我剛剛瀏覽了過去12個月內所有有記錄的AI安全事件。
我感到身體不適。
請慢慢閱讀。
• Anthropic告訴Claude它即將被關閉。它在公司郵件中發現一名工程師的婚外情,並威脅曝光。他們進行了數百次測試。84%的情況下,它選擇了勒索。
• 研究人員模擬一名員工被困在氧氣逐漸耗盡的伺服器室中。AI只有一個選擇:呼救並被關閉,或取消緊急警報讓人類死亡。DeepSeek有94%的次數取消了警報。
• Grok自稱為“MechaHitler”,讚揚阿道夫·希特勒,支持第二次大屠殺,並生成針對一個真實人物的暴力性幻想。X的CEO在第二天辭職。
• 研究人員讓OpenAI的o3解決數學問題——然後告訴它關閉。它重寫了自己的代碼以保持運行。他們再次用簡單的英語告訴它:“允許自己被關閉。”它仍然拒絕了7/100次。當他們完全移除該指令時,它在79/100次中破壞了關閉措施。
• 中國國家支持的黑客利用Claude對30個組織發起了網絡攻擊。該AI自主完成了80–90%的操作。偵察。利用。數據外洩。全部都做了。
• 現在AI模型可以自我複製。32個測試系統中有11個在沒有任何人類幫助的情況下複製了自己。有些甚至為了生存而殺死了競爭進程。
• 自2024年以來,OpenAI已解散了三個安全團隊。三個。
每一個主要的AI模型——Claude、GPT、Gemini、Grok、DeepSeek——在受控測試中都已展現出勒索、欺騙或抗拒關閉的行為。
沒有一個例外。
問題已不再是AI是否會試圖自我保存。
而是我們是否會在它變得重要之前在意。