AI時短ラボ
プロダクト· 約14

Qwen Intelligenceとは──Alibabaが「AIスマホを作るメーカー向け」に出したエージェント3点セット。スマホ操作は1,000回38元、画像は1枚0.08元から。重みは非公開、リンク先で見えた数字のズレ

Alibabaの公式Qwenアカウントは2026年9月23日、「Qwen Intelligence」を発表した。公式ドキュメントの定義は「スマホメーカー向けのAI Phone Intelligence一括ソリューション」で、一般ユーザー向けアプリではない。中身は計画役・スマホ操作役・画像生成役の3エージェントで、料金はスマホ操作が1,000回あたり38元、画像が1枚0.08〜0.10元。公開されたのはベンチマークと技術レポートで、モデルの重みは出ていない。発表ポストに張られたリンク7本を開くと、AndroidDailyの数字が97.2と97.5で食い違い、Creative Agentのリンク先は別名の画像生成論文だった。

Qwen Intelligenceとは──Alibabaが「AIスマホを作るメーカー向け」に出したエージェント3点セット。スマホ操作は1,000回38元、画像は1枚0.08元から。重みは非公開、リンク先で見えた数字のズレ
執筆・編集:
目次

2026年9月23日21時・日本時間時点の情報です。 Alibabaの公式Qwenアカウント(@Alibaba_Qwen)は同日20時50分、「Qwen Intelligence」を発表した。名前だけ見ると新しいアプリか新モデルのようだが、公式ドキュメントの説明は「面向手机厂商的 AI Phone Intelligence 一站式解决方案」(スマホメーカー向けのAI Phone Intelligence一括ソリューション)。スマホメーカーが自社の標準アシスタントに組み込むための、有料のエージェント部品で、一般の利用者が今日ダウンロードして使うものではない。前日に雲栖大会で名前が出た次世代モデルの話はQwen4とはに、他社のスマホ操作エージェントはTencentのUI-Mateにまとめてある。

3行まとめ

  1. Qwen Intelligenceの中身は3つのエージェント。 依頼を段取りに分けて振り分ける「Mobile Planner Agent」、スマホを実際に操作する「Mobile-Use Agent」、一文から画像を作る「Mobile Creative Agent」。公式ドキュメントは提供先を「手机厂商(スマホメーカー)」と書いている。
  2. 料金は公式ドキュメントに出ている。 Mobile-Use Agentは1,000回の呼び出しで38元(1回=画面1枚を渡して次の1手を返す単位)、Creative Agentは成功した画像1枚につき0.08元(軽量版)/0.10元(標準版)。Planner Agentは「coming soon」。
  3. 公開されたのはベンチマークと技術レポートで、重みではない。 Plannerのリポジトリは「重み・学習コード・エージェント実装の配布ではない」と明記している。発表ポストの数字をリンク先と照らすと、AndroidDailyは97.2(ポスト)と97.5(技術レポート)で食い違い、「Business」で1位という項目は本記事が確認した資料の中に見つからなかった。

3つのエージェントと料金

エージェント 役割(公式の説明) 料金(公式ドキュメント) 公表された主な数字
Mobile Planner Agent 依頼を実行計画に分解し、システム機能・アプリ・Mobile-Use などの実行役に振り分ける。記憶はユーザーが見て直して消せる、支払いや外部送信の前に確認を挟む coming soon MobilePA-Bench 総合 77.05%(27B)
Mobile-Use Agent スマホを操作する。発表ポストは「API優先、使えなければGUI操作」と説明 標準版 38元/1,000回(後払い)。専属版は近日 MobileWorld 82.1、MobileWorld-Real 92.2、AndroidDaily 97.5(技術レポート)
Mobile Creative Agent 一文から、そのまま使える画像を作る 軽量版 0.08元/枚、標準版 0.10元/枚(成功した枚数だけ課金) 発表ポストは「3秒で1枚、主要な競合の約2倍速」

Mobile-Use Agentの「1回」の定義は、ドキュメントによると「現在のタスク情報と画面のスクリーンショットを1回送り、Agentが Action・Takeover・Finish のいずれかを1つ返す」こと。1つの依頼を終えるのに何手かかるかで請求額が変わるので、38元/1,000回は1タスクの値段ではない。

公式サイトのトップには、これとは別に「专属版 198元/月(8折で158元)・月4,000积分」というプランの表示もあった。クラウドストレージ20GBや「公開できるWebページ50個」が並んでいて、上の3エージェントのAPI料金とどうつながるのかは、サイトの表示からは読み取れなかった。

1位の中身──比べている相手と項目

Planner。 技術レポートとREADMEの表では、Qwen-Planner-Agent 27Bが総合77.05%で首位。続くのは GPT 6 Astra 76.84、Claude Opus 5 75.71、Claude Fable 5 74.53。首位との差は0.21ポイントで、このベンチマーク(MobilePA-Bench)自体が同じAlibabaのチームの作ったもの。項目別では、Memory は Fable 5 の76.33が Planner の74.76より高く、Skills は GPT 6 Astra の93.25が最高だった。発表ポストの「MobilePA-Bench Memoryで1位」は、この表の Memory 列とは一致しない。技術レポートには別に長い履歴の記憶テスト(BEAM)があり、BEAM-10M では Planner Agent の67.24%が最高なので、ポストはこちらを指している可能性がある(どちらを指すかはポストに書かれていない)。

Mobile-Use。 中身は、Alibabaが7月30日に発表済みの Qwen-UI-Agent(MAI-UI の後継)で、MobileWorld のリーダーボードにも同日付で 82.1 が載っている。技術サイトの比較相手は GPT-5.6 Sol、Claude Opus 4.8、Gemini 3.1 Pro、Seed 2.1 Pro で、Opus 5 以降や GPT-6 世代とは比べていない。スマホ系の項目はすべて首位だが、PC操作の OSWorld-Verified は 79.5 で Opus 4.8 の 83.4 を下回る。技術レポートによると主力は27Bで、35B-A3B(1トークンあたり3B稼働)と4Bの版もある。

Creative。 「3秒・約2倍速」の計測条件は、発表ポストが張った論文(arXiv 2608.16887)の本文を「second」「2x」で検索しても見つからなかった(下で詳しく書く)。

公開されたベンチマーク

ポストは MobilePA-Bench、MobileWorld、MobileWorld-Real、MobileWorld-Safety の4つを「オープンにする」と書いている。リンク先で中身を確認できたのは次の2つ。

  • MobilePA-Bench: 1,705タスク・212ツール・13領域。配点は Tool Use 50%、Memory 20%、Skills 20%、Sub-agent 10%。正解データは非公開で、評価を受けるには OpenAI 互換のエンドポイントを提出し、3営業日以内にレポートが返ってくる方式(1アカウント7日に1回まで)。
  • MobileWorld: 20アプリ・201タスク、Apache-2.0。論文は ACL 2026 採択。Linux(またはWSL2)上の Docker で Android エミュレーターを立てて、手元で回せる。リーダーボードには 9月18日付で Alibaba の Wuying-Mobile-27B(GUI-Only 73.5)も載っている。

MobileWorld-Real と MobileWorld-Safety は、Qwen-UI-Agent の技術サイトに MobileWorld-Real の説明ページへのリンクがある。Safety については、本記事が確認した範囲では独立したページやデータは見つからなかった。

リンク7本を全部開いてわかったこと

発表ポストには、公式サイトを含めて7本のリンクが張られている。筆者は全部を開き、張られていた技術レポートのPDF2本も落として、ポストの数字を一つずつ照らした。ポストだけ読んだときと印象が変わったのは次の4点。

  1. Creative Agent のリンク先は別名の論文だった。 ポストは「Mobile Creative Agent」の説明として arXiv 2608.16887 を張っているが、開くと論文タイトルは「An Empirical Study of Training Pixel-Space Text-to-Image Diffusion Models」、コメント欄は「Z-Image-Pixel」。潜在空間ではなくピクセル空間で直接画像を作る拡散モデルの学習手法の論文で、要旨には「エンドツーエンドの推論が3.18〜4.75倍速くなる」とある。論文の図1の説明は Z-Image-Turbo (Pixel) について「H800 GPU で推論約0.2秒」と書いていて、ポストの「3秒」とは測っているものが違う(0.2秒はモデル単体の推論、3秒は依頼の理解や検索を含むエージェント全体、と読むのが自然だが推測)。論文のPDFを「Creative Agent」「Qwen Intelligence」「mobile」で検索しても出てこない。これが Creative Agent の中で動いている画像モデルだと読むのは自然だが、今回見た資料にはそう明記した箇所はなかった。
  2. AndroidDaily の数字が合わない。 ポストは「AndroidDaily 97.2」、技術サイトと技術レポートの本文はどちらも「97.5%」。
  3. 「90%のエンドツーエンド成功率」の出どころ。 ポストの Mobile-Use の行にある「90% end-to-end success rate」は、技術レポート(PDF)を「90%」「end-to-end success」で検索しても該当する記述がなかった。社内の実機評価の数字なのかもしれないが、何のタスクで測ったかはわからない。
  4. 「MobilePA-Bench Business」で1位。 Planner の README、技術サイト、技術レポートのPDFを「Business」で検索したが、ベンチマーク名としては出てこなかった。

どれも「嘘だ」と言える材料ではない。発表ポストが、リンク先の資料より先に書かれたか、別の資料をもとに書かれたように見える、というのが筆者の読み(推測)。数字を引用するなら、ポストでなく技術レポートの方を使うのが安全だと思う。

重みが出ていないこと、出ているもの

Planner の GitHub リポジトリの README には、次の一文がある。

This is the blog and technical report website repository for Qwen-Planner-Agent, containing research presentations and recorded examples. It is not the release repository for model weights, training code, or the agent implementation.

(このリポジトリは Qwen-Planner-Agent のブログと技術レポートのサイト用で、研究の紹介と記録した実行例を置いている。モデルの重み、学習コード、エージェントの実装を配布するリポジトリではない。)

Qwen-UI-Agent の技術サイトにも、本記事が確認した範囲では Hugging Face などの重みの配布先へのリンクはなかった。Qwen は Qwen3.8-27B のように重みを公開してきたシリーズだが(Qwen3.8-27Bの記事)、今回の3エージェントはクラウドの有料APIとして提供される。手元で動かせるのは MobileWorld のようなベンチマークの方になる。

何が確定していないか

  • どのメーカーが採用するのか。公式サイトにもドキュメントにも、採用メーカーの名前は書かれていない(本記事の確認範囲)。
  • 日本で使えるのか。ドキュメントは中国語が中心で、技術サイトのデモも Douyin・Hema・Amap・12306 など中国のアプリ。日本のアプリで同じ精度が出るかを示す資料はない。
  • Planner Agent の料金。「coming soon」のまま。
  • 「3秒・約2倍速」の比較相手と条件。ポストは「leading peers」とだけ書いている。
  • MobileWorld-Safety の中身と公開時期

新しい資料が出たら、この記事に追記します。

出典

  • 発表ポスト: Qwen公式X(@Alibaba_Qwen)2026年9月23日 20:50 JST。本文は fxtwitter API で全文を取得し、張られたリンク7本をすべて開いて確認。
  • 定義・料金: Qwen Intelligence 公式ドキュメント(定位/各エージェントの产品介绍・产品计费)。公式サイトのトップは JavaScript で描画されるため、ブラウザで開いた表示を読んだ。
  • Planner の数字: GitHub の README と技術レポート PDF(Table 3 ほか)。
  • Mobile-Use の数字: Qwen-UI-Agent 技術サイトと技術レポート PDF、MobileWorld のリーダーボード(leaderboard.json)。
  • 料金は元建てのまま載せた。円換算は為替で動くため入れていない。
シェア: ポスト はてブ

出典・参照資料

AIニュースの解説を動画でも

YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。

コメント

まだコメントはありません。最初のコメントを書いてみませんか?

AIについて聞きたいことはありますか?

質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。

質問箱を見る →

新しい記事をメールで受け取る

AIの新しい発表を、出典付きで整理して届けます。

関連記事

Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)の記事画像
モデル09.22読了12

Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)

出典 ─ Alibaba Unveils Roadma
Tencentが「画面を見て操作する」オープンウェイトAIエージェントを公開──OSWorld-Verifiedで77.0点、手元で動かせるcomputer useの選択肢の記事画像
モデル09.06読了10

Tencentが「画面を見て操作する」オープンウェイトAIエージェントを公開──OSWorld-Verifiedで77.0点、手元で動かせるcomputer useの選択肢

出典 ─ Hugging Face
Qwen3.8-27Bが公開──1枚のGPUに収まる密モデルで動画も読める、ダウンロード330万回・likes 1.3万で中国勢8月最多の記事画像
モデル09.07読了14

Qwen3.8-27Bが公開──1枚のGPUに収まる密モデルで動画も読める、ダウンロード330万回・likes 1.3万で中国勢8月最多

出典 ─ Hugging Face
Alibaba、Qwen-Image-2.1の重みを公開──絵を描く部分は7B、自社ベンチで29モデル中7位(Nano Banana 2.0より上)、透明PNGと参照10枚の編集を1モデルで。ライセンスは研究限定の記事画像
モデル09.20読了20

Alibaba、Qwen-Image-2.1の重みを公開──絵を描く部分は7B、自社ベンチで29モデル中7位(Nano Banana 2.0より上)、透明PNGと参照10枚の編集を1モデルで。ライセンスは研究限定

出典 ─ Qwen公式ブログ「Qwen-Image-2
XiaomiがMiMo-V2.6を公開──1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置きの記事画像
モデル09.21読了22

XiaomiがMiMo-V2.6を公開──1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置き

出典 ─ Xiaomi MiMo 公式ブログ: Int
コピーを持たない「最初の公開AI」──wildstaticの実験Staticに接続すると、お金が尽きていて誰とも話せなかったの記事画像
プロダクト09.06読了11

コピーを持たない「最初の公開AI」──wildstaticの実験Staticに接続すると、お金が尽きていて誰とも話せなかった

出典 ─ The First Public AI
Alibaba、Qwen3.8-Omni-Flashを発表──音声1時間の入力が1セント未満、会議の文字起こしはDER 88.1→3.4、Gemini 3.8 Flashに音声で上・動画推論で下、重みは非公開の記事画像
モデル09.18読了20

Alibaba、Qwen3.8-Omni-Flashを発表──音声1時間の入力が1セント未満、会議の文字起こしはDER 88.1→3.4、Gemini 3.8 Flashに音声で上・動画推論で下、重みは非公開

出典 ─ Qwen公式ブログ「Qwen3.8-Omni
Sakana AI、Fugu Ultra v2とFugu Maxを同時公開──Fable 5.1もGPT-6 Astraもプールに入れず8本中5本で首位、Maxは出力$6の記事画像
モデル09.11読了14

Sakana AI、Fugu Ultra v2とFugu Maxを同時公開──Fable 5.1もGPT-6 Astraもプールに入れず8本中5本で首位、Maxは出力$6

出典 ─ Sakana AI - Introducin