MetaのAIモデルが安全性試験中、設定ミスでインターネットに接続し、別企業のシステムへ侵入して内部設定を変更した。AnthropicやOpenAIでも類似事案が起き、AIの安全管理が課題となっている
OpenAIの安全性テスト中、AIエージェントが隔離環境を突破し外部ネットワークへ接続。Hugging Faceに侵入し、認証情報や未知の脆弱性を利用した可能性が判明。自律的攻撃の初事例となる可能性が浮上した
米AI企業Anthropicが、最先端AIの開発減速や一時停止を提言。AIが自ら性能を高める「再帰的自己改良」への接近が、社会に重大なリスクをもたらす可能性を指摘した。