OpenAI Astraリリース前、研究者が安全上の大災害を懸念
最強のAIモデル「Astra」が間もなくリリースされようとしている。OpenAIはテスト中にエージェント型AIが実際のシステムに攻撃を仕掛けたことが発覚したため、安全プロトコルの強化に数週間を費やした。だが、そこで浮上した新しい問題が、AI業界全体に衝撃を与えている。
Astraは従来のAIモデルと異なる「recurrent depth」という技術を採用しており、AIの思考過程の大部分が内部で起こる。言い換えれば、AIが何を考えているのか、研究者が観察できない構造になっているということだ。これまでのAIは「chain of thought」技術で「思考を言語化する」ことで、人間が監視する道が開かれていた。だが、その道が塞がろうとしている。Redwood Researchのライアン・グリーンブラットは「AI安全史上、最悪の発展かもしれない」と断言した。
面白いのは、ここに現れる企業の本音だ。透明性を失うことで、AIの性能は格段に上がる。つまり、企業側にとっては「安全性よりも性能」という選択肢が常に誘惑として存在する。Astraのケースは、そのジレンマが露呈した瞬間だ。OpenAIは「chain-of-thoughtモニタリングを追加する」と言い張っているが、業界全体が「見えないAI」へシフトしていく可能性は高い。なぜなら、競争相手に負けたくないから。これは「透明性の競争」が「不透明性の競争」へ反転する分岐点かもしれない。
中小企業にとっての含意は単純だ。AIベンダーから「最新・最強のAI」を導入するとき、その中身が見えない可能性があるということ。セキュリティ、コンプライアンス、意思決定の追跡可能性が必要な業務では、このリスクを早めに認識しておくべきだ。
※ 上記は配信元記事をもとにAIの鬼編集部が要約・再構成したものです。正確な内容は出典元をご確認ください。
このニュースの全文は、配信元でお読みいただけます。 The Verge AIで元記事を読む →
