アリババは Qwen 3.8-Flash-Next を発表し、Qwen 4 アーキテクチャをプレビューします。
阿里巴巴 Qwen チームは水曜日に Qwen 3.8-Flash-Next を発表します。これは混合専門家(MoE)モデルで、総パラメータは 1250 億ですが、各トークンは 60 億のパラメータのみを活性化します。チームはこれを次世代 Qwen 4 アーキテクチャのプレビュー版として位置付けており、最終的なフラッグシップモデルではありません。
このモデルはマルチモーダルとして説明されており、今後発表される Qwen 4 アーキテクチャに基づいて構築されています。チームは、この初期バージョンを早期にリリースすることで、開発者が後続の完全な Qwen シリーズに備えられるようにすることを目的としています。モデルの重みは Hugging Face と ModelScope プラットフォームでホスティングされます。
現在のところ、Qwen はこのモデルのベンチマークスコアを発表しておらず、自社の Qwen 3 シリーズや海外の競合製品との比較データも公開していません。1250 億と 60 億のパラメータの具体的な数字は公式に確認されていません。オープンウェイトモデルとして、開発者は無料でダウンロード、微調整、実行が可能で、データをクローズド API に送信する必要がなく、モデルのホスティングコストを削減するのに役立ちます。
関連タグ






