AWS、AIエージェント向け判断モデルを無償公開
判断処理の仕組み
約20億パラメータ
選択肢の直接採点
確率分布の一括出力
公開範囲と運用
Apache 2.0ライセンス
学習資料とコードの公開
ローカル実行への対応
性能と注意点
短い処理は数十ミリ秒
安全判断を補う位置付け
詳細を読む
Amazon Web Services(AWS)は2026年10月1日、AIエージェントの処理判断に特化した約20億パラメータのオープンモデル「Strands Decider 2B」を公開しました。文章を生成せず、あらかじめ定めた選択肢と確率を1回の推論で返し、頻繁な振り分けやツール選択の待ち時間と費用を抑える狙いです。
基盤はAlibabaのQwen3.5-2Bです。次の単語を予測する部品を選択肢の採点用部品に置き換え、利用可能な回答の確率分布を1回の推論で出力します。
用途はリクエストの振り分け、ツール選択、出力評価、エージェント行動の確認です。天気取得の例では、地名がないまま提案されたツール呼び出しを点検し、アプリ側が利用者へ場所を聞き直します。
モデルはApache 2.0ライセンスでHugging Faceから無償取得でき、企業は自社環境で調整・実行できます。AWSはコード、学習データ、スクリプトを含むv20の公開も予定しています。
速度は入力や機器で変わり、AWSは短い処理ならローカルで数十ミリ秒と説明する一方、RTX 3090上のv18では中央値106ミリ秒、95パーセンタイル296ミリ秒でした。公開JevBenchでv19の精度は約72%ですが、Jev自体との直接比較は示されていません。
ホスト型APIはなく、利用者が計算資源と運用を担うため、実際の費用優位は未確認です。またモデルは判断を返すだけで、その後の処理や安全対策は開発者が設計する必要があります。