Copilotのモデル選択、GrokとGPT・Claudeの違いは?
画像出典: ぱくたそ
Microsoftは2026年9月12日、Word・Excel・PowerPointのCopilotにxAI(SpaceXAI)のGrokを追加すると発表しました。Microsoft Frontier Programを通じた先行提供(プレビュー)からの開始で、既定はオフ、IT管理者が有効化して初めて社員が選べます。CopilotのモデルはすでにGPT・Claude・Autoが選べる状態で、Grokは3つ目の外部モデルという位置づけです。
ExcelやWordのCopilotは、少し前まで「裏で動いているAIは1種類」でした。それが2026年6月頃から画面右上のドロップダウンでモデルを選べるようになり、2026年9月12日の発表でGrokが加わります。同じ作業をする相手を、作業ごとに指名できるようになった、というのが今回の変化です。
とはいえ、選べること自体は答えになりません。正直なところ、名前が3つ並んでも「で、どれ?」となるだけです。仕組みのほうから見ていくと、選び方の筋が通ります。
Copilotに加わったGrokとは?何が発表された?
Microsoftは2026年9月12日、Word・Excel・PowerPointのCopilotにxAI(SpaceXAI)の「Grok」モデルを追加すると発表しました。いきなり全員に配られるのではなく、Microsoft Frontier Programを通じた先行提供(プレビュー)からの開始です。プレビュー期間中、EU・EFTA・英国の顧客には提供されません。
Grokは、単体では軽妙で皮肉めいたトーンで知られるモデルです。ただしCopilotの中では、Microsoftのシステムプロンプト(AIへの指示の土台となる設定文)と企業向けのガードレールの下で動くため、砕けた口調は抑制され、一貫してプロフェッショナルな応答になるよう設計されています。表計算の画面で急に冗談が返ってくる、という心配は要りません。
なお「Grok」という名は、ロバート・A・ハインラインの小説『異星の客』に由来します。xAIは2026年2月にSpaceXに買収される形での統合が発表され、2026年7月に「SpaceXAI」というブランド表記になりました。
なぜ1つの画面で複数のモデルを切り替えられる?
Copilotは、Microsoftが作った1つのAIが全部を担当しているわけではありません。Copilotは「窓口」で、応答を作る本体は外部のAI企業のモデルという構造です。窓口が共通だから、後ろに立つ担当者を入れ替えても、こちら側の操作は変わりません。
入れ替えを可能にしているのが、契約上の枠組みです。Microsoftは外部のモデル提供元を「Online Services Subprocessor List(下請け処理者リスト)」に登録し、その枠の中でデータを処理させます。SpaceXAIも今回このリストに追加されました。取引先に業務を再委託するときの名簿に、新しい社名が載ったようなものです。
この並存にMicrosoftが向かう狙いは2点とされています。ひとつは顧客にモデル選択の自由を与えること、もうひとつは単一の提供元で障害や不具合が起きたときの冗長性を確保することです。
ここが今回いちばん誤解されやすいところです。Grokモデルへのアクセスは管理者向けの専用設定で制御され、既定ではオフになっています。組織のIT管理者が有効化して初めて、社員の画面に選択肢として現れます。個人の設定をいくら探しても出てこない場合、原因は自分の側にないことが多いのです。
GPT・Claude・Grokは、それぞれ何に向いている?
まず前置きが必要です。3つのモデルの「得意・不得意」について、Microsoftが公式のベンチマーク(性能を測る共通テスト)を出して比較しているわけではありません。以下は第三者の比較記事に共通する傾向の整理であり、順位を決める性能表ではない、と受け取ってください。
| モデル | 提供元・位置づけ | 強いとされる傾向 | Copilotで向く場面 |
|---|---|---|---|
| GPT | OpenAI。既定(デフォルト)として長く使われてきた | ツールの利用や正確なファイル操作、同じ作業をより少ない出力で終える効率 | アプリを行き来せず、日常の作成・編集をそのまま片づけたいとき |
| Claude | Anthropic。一部テナントで選択可能 | 長文コンテキストの処理、複雑な推論、全体構成の判断など「深く考える」処理 | 長い資料の分析・要約、複雑な文章の推敲 |
| Grok | SpaceXAI(xAI)。2026年9月12日発表、プレビュー提供 | 多段階の論理展開、数学的な処理 | 数式処理やデータ分析寄りの作業 |
Microsoftおよび複数の比較記事の情報をもとに作成
上の表を一言にすると、迷ったら既定のまま、長い文章と向き合う日はClaude、数字と式が主役の日はGrokという順序になります。GPTは「特別な理由がないときの標準」、ClaudeとGrokは「作業の性質がはっきりしている日の指名」と考えると選びやすくなります。
数字を見るときの注意点
比較記事の中には、Claudeが科学的推論のベンチマークGPQA Diamond(大学院レベルの科学知識を問う試験)で91.3%、実務的なソフトウェア開発のベンチマークSWE-bench Verified(実在のバグ修正課題を解かせる試験)で80.8%(GPTは約80%)とする集計もあります。ただしこれは第三者ブログの独自集計で、一次情報ではありません。何を測った数字なのかと、誰が出した数字なのかを見てから読むものであって、この数字で日々の作業の相手を決める必要はありません。
そもそもCopilotでの体感を左右するのは、ベンチマークの小数点以下より、扱う文書の長さや作業の種類です。
Word・Excelでモデルを切り替える手順は?
- Copilotを開くExcelなら、Copilotで編集する画面を開きます。
- モデルスイッチャーを探す画面上部のドロップダウンから「AIモデルスイッチャー」を選びます。設定メニューの中に折りたたまれている場合もあります。
- 一覧からモデルを選ぶ表示された一覧から使いたいモデルを選びます。「Auto」は、Copilotが状況に応じて内部で最適なモデルを自動選択するモードです。
- そのまま指示を書く操作の手順は選んだモデルによって変わりません。プロンプトの書き方を覚え直す必要はありません。
- 管理者側でそのモデルが有効化されていない(Grokは既定でオフ)
- ライセンスやテナントの種別が対象外
- アプリのバージョンが古い
- プレビュー期間中のため、地域が提供対象外(EU・EFTA・英国)
この4つはいずれも、個人の設定画面では解決できません。思い当たるならIT管理部門に「Copilotのモデル選択を有効にできるか」と一度聞いてみるのが、いちばん早い道です。
切り替えられることで、仕事は何が変わる?
変化は「性能が上がる」より「相談相手を選べる」に近いものです。たとえば同じExcelファイルでも、来期予算の複雑な計算ロジックを組むときと、シートの内容を報告文にまとめるときでは、求めているものが違います。前者は多段階の論理を追う力、後者は長い文脈を保って整える力です。
これまでは1種類のモデルに両方をやらせていました。これからは作業の性質に合わせて担当を指名できるようになる、というのが実務上の意味です。
Grokの追加は現時点でプレビュー提供で、既定はオフ。組織が有効化しなければ選択肢は現れません。また、モデルを変えれば出力が必ず良くなるわけでもありません。指示が曖昧なら、どのモデルでも曖昧な答えが返ってきます。切り替えは、プロンプトを丁寧に書いたうえで効いてくる調整であって、その代わりにはなりません。
加えて、Microsoftはモデルの提供前にテスト・安全性検証・Responsible AIレビューを実施しているとしていますが、業務データをどのモデルに渡してよいかの判断は組織の方針によります。社内ルールを確認してから使い分けてください。
選択肢が増えたときの正しい向き合い方は、全部を試すことではありません。普段は既定で進め、うまくいかなかった作業が出てきたときに「この作業なら別のモデルかもしれない」と切り替えてみる。その一往復を何度か繰り返すうちに、自分の仕事における使い分けの勘所が見えてきます。
よくある質問
CopilotのGrokはいつから使える?
Microsoftは2026年9月12日に、Word・Excel・PowerPointのCopilotへのGrok追加を発表しました。Microsoft Frontier Programを通じた先行提供(プレビュー)から始まり、プレビュー期間中はEU・EFTA・英国の顧客には提供されません。
Copilotのモデル選択のドロップダウンが表示されないのはなぜ?
主な原因は3点あります。管理者側でモデルが有効化されていない、ライセンスやテナントの種別が対象外、アプリのバージョンが古い、です。特にGrokは既定でオフのため、組織のIT管理者が有効化するまで選択肢に現れません。
CopilotのGrokは、X上のGrokと同じ口調で答える?
いいえ。Copilot内のGrokはMicrosoftのシステムプロンプトと企業向けガードレールの下で動くため、単体で知られる軽妙・皮肉めいたトーンは抑制され、一貫してプロフェッショナルな応答になるよう設計されています。
GPTとClaudeとGrokは、どう使い分ければいい?
第三者の比較記事に共通する傾向として、Microsoft 365のアプリ内でそのまま作業を片づけたいなら既定のAutoやGPT、長文の分析・要約や複雑な文章の推敲ならClaude、数式処理やデータ分析寄りの作業ならGrokという整理がされています。Microsoft公式の性能比較ではないため、傾向の目安として扱ってください。
※記事で使用した内容・数値は変更される場合があります。最新情報は公式サイトをご確認ください。