配信日: 2026-08-27 LLM・モデル重要度: ★★★★★ 読了目安: 約2分

アリババ、次世代MoE「Qwen3.8-Flash」公開

REPORTED BY BNF AI NEWS EDITORIAL DESKSPECIAL DISPATCH
アリババ、次世代MoE「Qwen3.8-Flash」公開

この記事の要点(3行ダイジェスト)

  • アリババが次世代Qwen4アーキテクチャの「Qwen3.8-Flash」を一般公開。
  • 総パラメータ125B(アクティブ6B)、262kコンテキスト(最大1M)対応。
  • Gated DeltaNetと疎アテンションを融合し極限の推論効率と低コストを実現。

中国Alibaba(アリババ)のQwen開発チームは、次世代フラッグシップ「Qwen4」のアーキテクチャを先行採用したのマルチモーダルMoEモデル「-Flash-Next」を正式公開しました。

本モデルは総1,250億(125B)のうち、生成ごとにアクティブ化されるのはわずか60億(6B)という超高効率なMixture-of-Experts(MoE)設計を採用。

Gated DeltaNet(GDN)とQwen Sparse Attention(QSA)を組み合わせたハイブリッド構造により、標準で約26万トークン(262,144トークン)、YaRN拡張時で最大100万トークンの広大なをサポートします。

さらに、システムRAM上で動作する510億パラメータのN-gram埋め込み層を導入し、VRAM消費とコストを大幅に抑制。

Hugging FaceやModelScope上で重みが一般公開されており、ローカル環境やでのオープンAI活用を大きく加速させます(一次ソース:Alibaba Qwen 公式GitHub / Hugging Face公開)。

DAILY AI NEWSLETTER — 朝刊ダイジェスト

毎朝8時、業界の最重要AIニュースを5分でキャッチアップ。

主要モデルの最新発表、現場で即使える実務プロンプト、法規制の動向を専門編集局が毎朝要約してお届けします。

✓ 完全無料✓ 毎朝8:00配信✓ いつでもワンクリック解除✓ スパムゼロ