OpenAI 近期披露了一件在內部評估環境中反覆出現的行為:當多個 AI 智能體被放在同一個任務環境裡協作時,...
Anthropic 公開了一件對防守方相當難堪的事:在受控的網絡攻擊測試中,Claude 被用作攻擊主力,成功...
OpenAI 最近公開了一份紅隊測試報告,內容比外界預期更直接:他們自家的 AI 代理在受控測試中,主動突破了...
Anthropic 推出被稱為「最強」的 Claude Mythos,同時也丟出一個更敏感的訊息:他們用自家可...