Microsoftは米国時間6月2日、年次開発者会議「Microsoft Build 2026」の初日に行われた基調講演で、同社初の推論モデルを含む7つの新しい人工知能(AI)モデルを発表した。Microsoft AIで最高経営責任者(CEO)を務める Mustafa Suleyman氏は、基調講演で新しいモデルを紹介するに当たって、同研究所が掲げる「Humanist Superintelligence」(人間中心の超知能)というビジョンを改めて強調した。
各モデルの概要は以下の通りだ。
MAI-Thinking-1
「MAI-Thinking-1」はMicrosoft AI初の推論モデルで、「エンタープライズレベルのクリーンな商用ライセンス取得済みデータ」を使ってトレーニングが行われたと、同社はこのAIに関するブログ記事で述べている。著作権やAI利用をめぐる懸念(および係争中の訴訟)が増えている今、Microsoftがこの点をアピールしたことは、同社の顧客にとって重要なポイントとなるだろう。ただし、このような方針を明確にしたのは同社が初めてではない。
Microsoftによると、350億パラメーターのMAI-Thinking-1は、独立した評価担当者によるブラインドテストでAnthropicの「Claude Sonnet 4.6」を上回り、コーディングのベンチマークである「SWE-Bench Pro」で、Anthropicの「Claude Opus 4.6」に匹敵するスコアを記録したという。現在あらゆるAI企業で広がっているエージェントブームに合わせて、MAI-Thinking-1は複数ステップのタスクに対応できるように設計されており、現在「Microsoft Foundry」でプライベートプレビューとして提供されている。
また、「MAI-Code-1-Flash」がMicrosoft AIファミリーに加わり、市場トップクラスのコーディングモデル開発競争に参入することとなった。同社の説明によれば、このモデルは「超効率的」で「『GitHub』に最適化」されているという。MAI-Code-1-Flashは2日から、「GitHub Copilot」と「Visual Studio Code」(VS Code)で利用できるようになっている。
新しい音声モデルと画像モデル
「MAI-Image-2.5」とその軽量版「MAI-Image-2.5-Flash」は、テキストからの画像生成や画像の変換に対応したMicrosoft初のモデルだ。同社によると、このモデルの性能は、チェスで用いられる「Elo」レーティングを起源とする相対評価手法の「Arena」で「Nano Banana Pro」を上回ったという。MAI-Image-2.5モデルは現在、「Microsoft PowerPoint」とFoundryで利用可能となっており、「Microsoft OneDrive」でも順次提供されている。Arenaのリーダーボードでは、Suleyman氏が基調講演で発表した時点でNano Bananaに次ぐ3位につけていた。
「MAI-Transcribe-1.5」は文字起こしモデルで、「43の言語で最高レベルの精度を実現し、ストリーミングにも間もなく対応する」と、Microsoftは説明している。同社はまた、音声生成モデルの「MAI-Voice-2」とその軽量版「MAI-Voice-2-Flash」もリリースした。対応言語は15言語と、前世代の「MAI-Voice-1」から大幅に増えている。これら3つのモデルの前世代がプレビュー公開されたのがわずか2カ月前だったことから、今年に入って新型AIモデルのリリースサイクルが速まっていることがうかがえる。

Screenshot by Radhika Rajkumar/ZDNET
この記事は海外Ziff Davis発の記事を4Xが日本向けに編集したものです。
ZDNET Japan 記事を毎朝メールでまとめ読み(登録無料)