it.xnews.jp
出典: Strands Agents 原文公開: 2026-10-01 生成: 2026-10-07 読了 約 3 分 model: claude-haiku-4-5 原文: https://strandsagents.com/blog/introducing-strands-decider/ raw.md

Strands Decider 2B、オープンソースの決定モデルを発表

Strandsは、エージェントAIアプリケーション向けの小規模オープンソース決定モデル「Strands Decider 2B」を発表した。2億個のパラメータを持ち、ローカル環境での実行に最適化されている。

決定モデル「Strands Decider 2B」が登場。2億個のパラメータを備え、ローカルCPUやGPUで実行可能で、数十ミリ秒の低遅延レスポンスを実現する。GitHub上でオープンソース化され、Hugging Face上でウェイトが公開されている。

Strandsは今年初めにstrands-labsをエージェントAIの最先端アプローチに取り組む場所として発表し、その一環として本モデルをリリースした。Strands Decider 2Bは、オプション群から最適な選択肢を選び数値スコアを割り当てるよう設計された決定モデルである。モデルルーティング、ツール選択、評価、ガードレール、エージェント・ワークフローなど多くの用途に対応する。

アーキテクチャと性能

アーキテクチャ図

Strands Decider 2Bのコアアーキテクチャは、事前学習済みLLMである「Qwen3.5-2B」をベースとし、言語モデルヘッドを削除して「ポインターヘッド」に置き換えている。ポインターヘッドは約100万個のパラメータで構成され、torsoはランク16のLoRAアダプターでファインチューニングされている。リリースモデルはv19であり、リポジトリには複数イテレーションが文書化されている。

遅延性能について、ローカルのNvidia RTX3090でのメディアン遅延は約115ミリ秒であり、M3 MacBook上の小規模タスクではメディアン遅延が約153ミリ秒となる。決定モデルは同サイズのLLMと比べて高速かつ高能力であり、選択肢から必ず答えを導出し、非常に低遅延で実行可能であるほか、各決定に高品質の信頼度スコアを付与する。

ベンチマークと精度

ベンチマーク結果

Strands Decider 2BはJevBench上で、2B級モデルの中で精度とキャリブレーションにおいて3位にランクされ、2B少し超えるモデルを除いた場合は30モデル中1位を獲得している。JevBench上の簡単なタスクについては100%の正答率を達成している。

実装と提供内容

遅延とトークン数の関係

Strands Decider 2Bはすべての訓練データと構築スクリプトを含めてGitHub上でオープンソース化されている。インストールは「pip install strands-decider」で行え、エージェント例ではget_weatherというツールを使用し、Strands Deciderをローカル実行しながらAmazon Bedrockをデフォルトで使用するLLMとして利用する。

この記事は元記事の事実のみに基づいて自動生成されました。

筆者の見立て

出典

Strands Agents「Introducing Strands Decider 2B: a small, open source, decision model」https://strandsagents.com/blog/introducing-strands-decider/

この記事をシェア