OmochiXを検索

Esc で閉じる

AIニュース

Grok 4.7正式リリース。xAIが「長時間働くAI」を強化、GPT・Claudeとの競争へ

SPACEXAI / FRONTIER MODEL / 2026.09.21 Grok 4.7 コーディング、AIエージェント、長時間タスクを強化。 AI競争は「答える」から「最後まで働く」へ。 > grok-4. […]

OmochiX 公開 更新 約9分で読めます
Grok news
SPACEXAI / FRONTIER MODEL / 2026.09.21
Grok 4.7

コーディング、AIエージェント、長時間タスクを強化。 AI競争は「答える」から「最後まで働く」へ。

> grok-4.7   ONLINE   /   context:500K   /   agent:ready

SpaceXAIが2026年9月21日、最新フロンティアAIモデル 「Grok 4.7」を正式公開しました。

今回の進化で特に重視されているのは、 単純に質問へ答える能力だけではありません。 コーディング、AIエージェント、長時間にわたる知識労働です。

難しい仕事をより長く続け、自分の作業を確認しながら進める。 Grok 4.7は、AIモデル競争が「回答性能」から 「どれだけ長く仕事を任せられるか」 へ移りつつあることを示すモデルになっています。

MODEL Grok 4.7
CONTEXT 500K tokens
FOCUS Agent / Coding
この記事のポイント
  • SpaceXAIがGrok 4.7を正式公開
  • Grok 4.6より大きな新しいベースモデルを採用
  • 数時間かかる難しいタスクを重視して強化学習
  • 自己検証と長いコンテキストの処理能力を改善
  • 500,000トークンのコンテキストウィンドウ
  • API、Cursor、Grok Buildなどですでに利用可能

Grok 4.7とは?

Grok 4.7は、SpaceXAIが コーディング、エージェント型タスク、ナレッジワーク 向けに開発した最新のフロンティアモデルです。

公式発表によると、Grok 4.6よりも大きな新しいベースモデルを採用。 さらに、より難しいタスクを使って長期間の強化学習を行っています。

特に学習では、数分で終わる問題だけではなく、 完了まで数時間を要するようなタスクへ重点が置かれました。

その結果、SpaceXAIはGrok 4.7について、 自分の作業を検証する能力や長いコンテキストを管理する能力が改善したと説明しています。

「長時間働けるAI」が重要になっている

現在のフロンティアAI競争では、 ベンチマークで難問を解けるかだけでなく、 長い作業工程をどこまでAIへ任せられるか が重要になっています。

たとえばソフトウェア開発では、 コードを一度生成するだけでは仕事は終わりません。

AGENT EXECUTION LOOP
ANALYZE → PLAN → EXECUTE → TEST → VERIFY → COMPLETE

既存コードを読み、問題を特定し、修正し、 テストで失敗すれば再び修正する。

こうした複数ステップを継続して実行できる能力は、 AIエージェントを実際の業務で使ううえで重要になります。

コーディング性能もGrok 4.6から向上

SpaceXAIが公開した公式ベンチマークでは、 複数の長時間タスクでGrok 4.6から改善しています。

46.3% CursorBench 4.0 ↑ 40.4% → 46.3%
38.0% Terminal-Bench 4.0 ↑ 20.3% → 38.0%
1,657 AA Briefcase v1.1 ↑ 1,546 → 1,657
500K Context Window LONG CONTEXT
BENCHMARK GROK 4.6 GROK 4.7
CursorBench 4.0 40.4% 46.3%
Terminal-Bench 4.0 20.3% 38.0%
AA Briefcase v1.1 1,546 1,657
EEBench 53.0% 64.0%

※数値はSpaceXAIが公開した評価結果です。 ベンチマーク結果は実際のすべての利用場面での性能を保証するものではありません。

GPTやClaudeをすべて上回ったわけではない

ここは重要です。

Grok 4.7は大きく性能を伸ばしていますが、 公開された比較を見る限り、 すべての評価で他社のフロンティアモデルを上回っているわけではありません。

たとえばSpaceXAIの公式比較では、 CursorBench 4.0でGrok 4.7が46.3%なのに対してFable 5.1は51.8%。 Terminal-Bench 4.0ではGrok 4.7が38.0%、Fable 5.1が57.9%となっています。

一方で、AA Briefcaseや法律、電気工学など、 Grok 4.7が非常に競争力のある結果を示している領域もあります。

そのため今回の注目点は、 単純な「世界最強AI」という話ではなく、 性能・速度・価格を含めた総合的な競争力 にあります。

料金は100万入力トークン2ドルから

Grok 4.7のAPI料金は、 20万トークン未満のプロンプトでは 100万入力トークンあたり2ドル、出力6ドルです。

GROK API / PRICING ● LIVE
INPUT $2 / 1M tokens
OUTPUT $6 / 1M tokens
CACHED INPUT $0.50 / 1M
CONTEXT 500K

ただし、20万トークンを超えるプロンプトでは料金体系が変わり、 入力4ドル、キャッシュ入力1ドル、出力12ドルとなります。

また、2倍の出力速度を提供する Grok 4.7 Fastも用意されています。 Fast版は標準版の2倍のトークン料金で、 現時点ではCursorとGrok Build向けに提供されています。

すでにAPIやCursorで利用可能

Grok 4.7は発表だけではなく、 すでに複数の環境で利用できます。

Grok API Grok Build Cursor OpenRouter Vercel Cloudflare

API上のモデル名は grok-4.7です。

安全対策も全面的に刷新

✓ NEW SAFEGUARD STACK

SpaceXAIはGrok 4.7で、 新しいセーフガードスタックを導入したとしています。

特にサイバーセキュリティや生物学など、 高性能AIが強くなるほど安全性が重要になる領域で、 有用性を維持しながら危険な要求を拒否する能力の改善を進めています。

AIモデルが長時間・自律的に仕事を行えるようになるほど、 モデルそのものの能力だけではなく、 権限管理、監視、人間による承認、安全な停止 も重要になります。

OmochiX視点:AI競争は「賢さ」から「働ける時間」へ

OmochiX VIEW / GROK 4.7

Grok 4.7で特に注目したいのは、 単純なベンチマーク順位ではありません。

SpaceXAIが「数時間かかる仕事」を、 明確にAIの学習対象として重視し始めたことです。

これまでの生成AIは、 人間が質問し、AIが回答する使い方が中心でした。

しかしAIエージェントでは、 人間がゴールを渡したあと、 AI自身が何十、何百もの処理を続ける世界へ進みます。

そのとき重要になるのは、 一瞬だけ賢いAIではなく、 長時間働き、途中で間違いを確認し、 最後まで仕事を完了できるAI です。

Grok 4.7の進化は、 OpenAI、Anthropic、Google、SpaceXAIなどによる競争が、 「どのAIが一番賢いか」から 「どのAIに一番仕事を任せられるか」 という段階へ進んでいることを示しています。

まとめ

SpaceXAIのGrok 4.7は、 コーディングや知識労働だけでなく、 長時間タスクとAIエージェントを強く意識したモデルです。

Grok 4.6から性能を伸ばしながら、 100万入力トークン2ドルからという価格を維持している点も注目されます。

AIモデル競争の次の焦点は、 回答の賢さだけではありません。

AIにどれだけ長く、安心して仕事を任せられるか。

Grok 4.7は、その競争が本格化していることを示すモデルのひとつと言えそうです。

あわせて読みたい

一次情報

PRIMARY SOURCE / SPACEXAI
Introducing Grok 4.7
x.ai/news/grok-4-7
DEVELOPER DOCUMENTATION
Grok 4.7 Developers
docs.x.ai/developers/grok-4-7

NEXT STEP

次に知りたいAI情報へ。

自分に合うAIツールを探す 最新のAIニュースをもっと見る

OmochiXをフォロー

最新のAIニュースや活用情報をSNSでも配信しています。