
Qwen3.8、最新世代のオープンモデルをリリース
Qwenチームが「Qwen-Max級」のオープンモデルであるQwen3.8をリリースした。テキスト専用モデルQwen3.8-2.4T-A95Bは総パラメータ数2.4T、アクティブパラメータ数95Bで、コーディング、エージェント実行、長文脈理解に対応している。
Qwenチームは、Qwen open-model family史上最も高性能な世代となるQwen3.8をリリースした。これは初めてQwen-Max級のモデルをオープンソースとして提供する取り組みである。Qwen3.5の設計基盤を継承しながら、コーディング、専門的な業務、研究、長期的なエージェントタスクにおいて大幅な改善を実現した。Qwen3.8は複雑で複数ステップのタスクをより高い信頼性で完遂するよう設計されている。
モデルの仕様と機能
Qwen3.8-2.4T-A95Bはテキスト専用モデルであり、すべてのインタラクションで思考モードが必須である。マルチモーダル入力には対応していない。総パラメータ数は2.4T、アクティブパラメータ数は95Bで、ネイティブコンテキスト長は262,144トークン、拡張可能なコンテキスト長は1,010,000トークンである。
アーキテクチャの詳細は以下の通りである。隠れ層の次元は8192、トークン埋め込みは248,320、層数は92である。Gated DeltaNetについて、V用の線形アテンション頭数は128、QK用は16、ヘッド次元は128。Gated Attentionについて、Q用のアテンション頭数は64、KV用は4、ヘッド次元は256。回転位置埋め込み次元は64である。Mixture of Expertsは512個の専門家で構成され、そのうちルーティングされた専門家は10個、共有専門家は1個、専門家の中間次元は2048である。
思考モードと推論制御
すべての応答は自動的に<think>タグで囲まれた推論で始まる。思考モードを無効にすることはできない。reasoning_effortは3段階のレベルに対応しており、デフォルトはxhigh、mediumおよびlowから選択可能である。preserve_thinkingはすべてのワークロードについてデフォルトで有効化されている。
互換性とQwen3.8-Max
Qwen3.8-2.4T-A95Bの生成物はvLLM、SGLang、TokenSpeedに対応している。またQwen3.8-Maxはこのモデルをベースとし、ビジョン入力、思考モード非対応オプション、デフォルトで1Mのコンテキスト長、公式ツール統合など追加機能を備えている。
この記事は元記事の事実のみに基づいて自動生成されました。
出典
Hugging Face「Qwen/Qwen3.8-2.4T-A95B · Hugging Face」https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B