ニュース
OpenAI、新モデル「Astra」リリースに向け安全対策を公表
2026年9月2日 14:57
OpenAIは、同社の次世代AIモデル「Astra」が重大な被害のリスクを十分に低減できる安全対策が講じられていると確信していると発表した。数週間にわたり、Astraの開発とリリースの一部を延期し、必要な安全対策が講じられているかの検証にあたっていたが、重大な被害のリスクを十分に低減できると判断したようだ。
Astraは、適切なツールとアクセス権限があれば、これまで知られていなかったセキュリティ上の欠陥を発見し、多くの厳重に保護されたシステムにおいて、人が指示することなく各ステップを突破し、これらを悪用する方法を開発できるレベルに達していると指定される最初のAIモデル。このレベルでは、開発中およびリリース前に、これまで以上に強力な保護措置が必要となる。
OpenAIでは、Hugging Face事件での教訓を活かし安全対策を見直し、当時の本番環境における安全対策が事件を防ぐことができたと考えているとし、その後、Astra向けにさらに強力な安全対策を導入したという。具体的に導入された対策としては、有害なサイバー要求をより確実に拒否し、安全上の制限を遵守するようモデルを訓練。不正使用に対する追加の保護措置、そして不正な活動の可能性を阻止できる監視機能など。
Astraは近日中に提供開始予定だが、最先端のサイバーセキュリティ機能へのアクセスは限定的となる。高度なサイバーセキュリティ機能は当初、一部のテスターグループに提供され、その後Daybreak Blueを通じてアクセスが可能となり、防御的な利用範囲が拡大される予定。




![Claude Code実践入門 [生成AI深掘りガイド] 製品画像:4位](https://m.media-amazon.com/images/I/41onRRY91KL._SL160_.jpg)
































