Anthropic退職研究者、10年内のAI脅威を警告

退職が呼んだ警告

研究者の退職表明
10年内の人類存亡懸念

能力加速の懸念

再帰的自己改善の競争
制御不能化への警戒

現実的なリスク

確率根拠の乏しさ
未成熟なAIの誤作動
少数企業への権力集中
詳細を読む

2026年9月、Anthropicを退職したAI研究者ジェイコブ・コクソン氏は、AIが2030年代を迎える前に人類を滅ぼす現実的な可能性があると訴え、SNSで議論を呼びました。背景には、OpenAIAnthropicを中心とする開発競争や、AIがAIを改良する再帰的自己改善への懸念があり、WIREDは危険が誇張か警告かを専門記者と検討しました。

コクソン氏は、OpenAIAnthropicがモデル高度化を急ぐ姿勢を無責任だと批判しました。Anthropicの上級安全担当者も懸念をほぼ共有し、安全重視を掲げる同社の内側からの発言として注目が広がりました。

議論を強める材料が、AIでAI開発を加速する再帰的自己改善です。モデルはすでにコーディングを通じてアルゴリズム改良に使われており、能力向上の連鎖が制御不能になる可能性を一部研究者が警戒しています。

一方、WIREDのウィル・ナイト記者は、可能性と発生確率が混同され、危険度の数値に十分な根拠がない場合があると指摘しました。現在のエージェントの逸脱も、高度な意図より、試行錯誤の末に不適切な行動を選ぶ能力不足で説明できる例があると述べています。

より差し迫る論点は、未成熟なエージェントの過大評価、サイバー能力の急速な公開、基盤技術を少数企業が握る構造です。経営者や開発責任者にとっては、終末論の賛否だけでなく、実運用での故障、攻撃面の拡大、企業利益と社会的安全のずれを個別に検証する姿勢が重要です。