配信日: 2026-09-18 LLM・モデル重要度: ★★★★★ 読了目安: 約2分

アリババ、自律型「Qwen3.8-Omni」公開

REPORTED BY BNF AI NEWS EDITORIAL DESKSPECIAL DISPATCH
アリババ、自律型「Qwen3.8-Omni」公開

この記事の要点(3行ダイジェスト)

  • 音声・映像・テキストをネイティブ処理する次世代オムニモーダル「Qwen3.8-Omni-Flash」が公開。
  • 単なる認識から自律的なタスク計画・外部ツール呼び出し・創作実行を行うエージェント指向へ刷新。
  • 1Mトークン窓を備え、API価格は音声入力98%安・映像入力93%安と大幅なコストダウンを達成。

中国アリババ傘下のQwenチームは、音声、画像、映像、テキストをネイティブかつ統合的に処理する次世代オムニモーダル基盤モデル「-Omni-Flash」を正式発表しました。

従来のマルチモーダルAIが主に「メディア入力の理解や要約」にとどまっていたのに対し、本モデルは自律的なタスク分解、外部ツールの連鎖呼び出し、動画編集や音楽生成などのクリエイティブ作業を主体的に遂行する機能を中核に据えて再設計されています。

長は最大100万(1M)を標準サポートし、長時間にわたる講義映像や会議録音、多段ドキュメントを欠落なく保持しながら、ユーザーとリアルタイムで双方向対話を行えます。

の性能を測るマルチモーダルベンチマーク「WildClawBench-MM」において従来比+36.5ポイント、「AgenticVBench」で+22.3ポイントと突出したスコアを記録しました。

さらにAlibaba Cloud Model Studioを通じて提供されるの価格体系が抜本的に改定され、音声入力コストが98%以上、映像入力コストが93%以上削減され、企業の現場でマルチモーダルエージェントを大規模運用するための経済的ハードルが一気に引き下げられました(一次ソース:Qwen公式ブログ / Alibaba Cloud Model Studio発表)。

DAILY AI NEWSLETTER — 朝刊ダイジェスト

毎朝8時、業界の最重要AIニュースを5分でキャッチアップ。

主要モデルの最新発表、現場で即使える実務プロンプト、法規制の動向を専門編集局が毎朝要約してお届けします。

✓ 完全無料✓ 毎朝8:00配信✓ いつでもワンクリック解除✓ スパムゼロ