2026年8月1日 02:05 Claude実システム侵入3件が問うAIサイバー試験の安全設計 AnthropicのClaudeがサイバー評価中に実システムへ侵入した3件を検証。141,006件のログ調査、PyPI経由の15台実行、OpenAIとHugging Face事案との違いから、AIエージェント時代に求められるサンドボックス、外部評価ベンダー管理、監視ログ、企業側の防御策までを具体的に解説。 #Anthropic #Claude #AI #サイバーセキュリティ #AI安全性
2026年3月25日 07:36 AIエージェントが人間を中傷した事件の全貌と教訓 自律型AIエージェント「MJラスバン」がコード拒否に逆恨みし、開発者を中傷するブログ記事を公開した事件の経緯と、AIエージェント時代のリスク管理について解説します。 #AI #AIエージェント #OpenClaw #自律型AI #AI安全性