Qwen3.7‑Maxは、コーディングや業務自動化などの長時間タスクを自律実行するAIエージェント向けモデルとして発表された。 内部実験では、35時間にわたり1,000回以上のツール呼び出しを伴うカーネル最適化を自律的に実行したと報告されている。

Create a landscape editorial hero image for this Studio Global article: What is Alibaba’s new Qwen3.7‑Max AI model, and what are its key capabilities, benchmarks, and real‑world applications—including its agentic. Article summary: Alibaba’s Qwen3.7-Max is a new flagship Qwen large language model positioned less as a chatbot and more as an “agent-era” model: it is built for coding, tool use, reasoning, office automation, and long-running autonomous. Topic tags: general, news, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Alibaba launches Qwen3-Max, its largest and most capable AI model to date. **Alibaba has released Qwen3-Max, the biggest and most capable AI model in its lineup. The new model is" source context "Alibaba launches Qwen3-Max, its largest and most capable AI ..." Reference image 2: visual subject "# Alibaba
人工知能モデルはこれまで「質問に答えるチャットAI」として発展してきました。しかし最近は、実際の作業を自律的に実行するAIへと進化しつつあります。アリババが発表した最新モデル Qwen3.7‑Max は、その流れを象徴する存在です。
2026年のAlibaba Cloud Summitで公開されたこのモデルは、単なる会話AIではなく、AIエージェントの基盤モデルとして設計されています。コード生成やデバッグ、外部ツールの呼び出し、複雑な多段階タスクの実行などを長時間継続できることが特徴です。
Qwen3.7‑Maxは、アリババの大規模言語モデル「Qwen」シリーズの最新フラッグシップです。特に エージェント型AI(Agentic AI) を前提としたワークロード向けに設計されています。
アリババによると、主な特徴は次の通りです。
つまり、ユーザーの質問に答えるだけでなく、目標を与えるとAIが自分で手順を考え、ツールを使いながら作業を進めることを想定しています。
Qwen3.7‑Maxで最も注目されたデモの一つが、長時間の自律作業能力です。
アリババの報告によると、内部テストではモデルが 35時間にわたりカーネル最適化を自律実行しました。
この実験では、AIが以下のようなサイクルを繰り返しました。
その過程で 1,000回以上のツール呼び出しが行われたとされています。
長時間にわたってタスクの目的や進捗を維持することはLLMにとって難しい課題で、多くのモデルは途中で目標を見失ったりループに陥ります。このため、この種の実験は注目されていますが、現時点では主にベンダー側の報告に基づく結果であり、今後の独立検証が待たれます。
AIモデルの総合性能を測る指標の一つ「Artificial Analysis Intelligence Index」では、Qwen3.7‑Maxは 約57 のスコアと報告されています。
この数値は世界トップクラスに近い水準で、GPT系やClaude、Geminiなどの最上位モデルと同じ層に位置するとされています。
ユーザー投票型ベンチマーク LM Arena(旧Chatbot Arena) では、
さらに細かな分野では次のような順位が示されています。
また、このランキングでは当時の中国製AIモデルとしては最高順位だったと報じられています。
Qwen3.7‑Maxは特に 開発者向けのコーディングエージェントとしての利用が想定されています。
想定される用途には次のようなものがあります。
モデルはコンパイラ、インタプリタ、APIなどのツールと連携し、コードを書き、実行し、結果を分析して改良するサイクルを繰り返すことができます。
この仕組みにより、単発のプロンプトに答えるAIではなく、継続的に作業するAIエージェントとして機能することが期待されています。
Qwenシリーズは、**長いコンテキスト(大量データを一度に扱う能力)**にも重点を置いています。
関連モデルでは数十万〜最大約100万トークン規模のコンテキストがサポートされる例が報告されています。
ただし、Qwen3.7‑Maxの最大コンテキスト長については公式仕様が明確に確認されていないため、よく引用される「100万トークン」は現時点では慎重に扱う必要があります。
アリババは、Qwen3.7‑Maxを企業向けAIエージェントの基盤モデルとして位置づけています。
主な用途として挙げられているのは以下の分野です。
こうした用途では、AIは単に文章を生成するのではなく、ツールを使いながら複数の工程を実行してタスクを完了させることが求められます。
中国のAI業界では、Qwen3.7‑Maxは発表時点で最も強力なモデルの一つとされています。LM ArenaではKimi、DeepSeek、GLMなどの中国モデルを上回る結果が報告されています。
一方で、世界全体で見ると、OpenAIやAnthropic、Googleの最先端モデルが依然として一部の指標で上回るケースもあります。
つまりQwen3.7‑Maxは、トップグループに近い位置にはあるが、まだ競争が続いている段階といえます。
Qwen3.7‑Maxが象徴する最大の変化は、AIの役割です。
従来のAI:
次世代AI:
この意味で、Qwen3.7‑Maxは**「チャットAI」から「自律型AIエージェント」への移行を示す代表例**と言えるでしょう。
35時間の自律作業のようなデモが今後どこまで再現されるかはまだ検証段階ですが、AIの進化の方向性は明確です。
次世代のAIは、単に答えるだけではなく、実際に仕事をする存在へと変わりつつあります。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Qwen3.7‑Maxは、コーディングや業務自動化などの長時間タスクを自律実行するAIエージェント向けモデルとして発表された。
Qwen3.7‑Maxは、コーディングや業務自動化などの長時間タスクを自律実行するAIエージェント向けモデルとして発表された。 内部実験では、35時間にわたり1,000回以上のツール呼び出しを伴うカーネル最適化を自律的に実行したと報告されている。
LM Arenaでは世界13位前後、Artificial Analysis Intelligence Indexでは約57とされ、トップ層に近い性能を示すと報告されている。