お問い合わせ
AIニュース

Mistral AI、16GB GPU1枚で動くAI安全分類器「Shieldstral 1.0」を無料公開 — 専任エンジニア不要・テキストでポリシー設定

この記事の監修者 株式会社デジタルゴリラ

Mistral AIは2026年8月4日、AIシステムのコンテンツ安全管理を担う分類器モデル「Shieldstral 1.0」をApache 2.0ライセンスでオープンソース公開した。3Bパラメータの軽量設計で、単体16GB GPUで動作する。

発表の概要

Shieldstral 1.0はテキスト・画像・テキストと画像の組み合わせを一つのインターフェースで評価できる、マルチモーダル対応の安全分類器だ。最大の特徴は、禁止カテゴリをモデルの重みに埋め込まない設計にある。

“you write the policy as a plain-language question at inference time”

(筆者意訳:推論時にプレーンテキストで方針を記述するだけでよい)

── Mistral AI 公式ブログ

これにより、サイバーセキュリティ研究用のプラットフォームからメンタルヘルス支援サービスまで、用途ごとに異なるコンテンツポリシーを再学習なしで切り替えられる。出力は連続的な確率スコアとして返されるため、閾値の調整も柔軟だ。

性能面では、マルチモーダルモデレーションで最高水準の精度を達成し、自身の最大7倍のパラメータ数を持つオープン分類器モデルと同等以上の結果を示した。Hugging Faceで無料ダウンロード可能で、商用利用も許諾されている。

中小企業が注目すべきポイント

AI安全対策はこれまで、高額なクラウドAPIや商用製品が中心だった。Shieldstralは無料・オープンウェイト・単体GPU動作という3条件が揃っており、専任の機械学習エンジニアがいない中小企業でも自社環境でのAI安全管理を内製化できる。ポリシーの変更は再学習不要で、テキストを書き換えるだけで即反映される。


出典: Mistral AI「Shieldstral 1.0」(2026年8月4日)

株式会社デジタルゴリラ