こんにちは!コロンビア大学の博士課程でAI・セキュリティの研究をしている Koukyosyumei です。 さて、読者のほとんどの方が Claude Code や Codex を使って開発をしていると思いますが、皆さんは「AIエージェントがシェルコマンドやネットワークアクセスを実行するときにどのように安全性を確認しているか」についてどこまで理解しているでしょうか? エージェントは様々な作業を自動で行ってくれますが、誤ってファイルを削除したり、機密情報を外部に送信したり、CPUリソースを食いつぶすような非効率なプログラムを実行したりする可能性があります。 もちろん、Claude Code や Codex はどちらもエージェントを安全に動かすための仕組みであるサンドボックスを内製しています。また h5i や docker-agent といったより高性能なエージェント向けサンドボックスも注目を集

