xAI/Grok 4.6
xAIの最も知能の高いモデル
500Kトークンのコンテキスト、より強力な長時間稼働エージェント、そしてトップクラスのコーディング。野心的なインタラクティブ・ビジュアル作品のために作られています。セットアップ不要で、ブラウザ上でそのまま活用できます。
モデルはGrok 4.6 に設定済み · サインアップでさらに多くのモデルが利用可能
話題のGrok 4.6 活用例
Xコミュニティで話題の実践例です。Grok 4.6 で実際に作られているもの、ゲーム、3D ワールド、シミュレーション、レンダリング、モデル同士の直接比較などをご紹介します。
同じプロンプトで最高推論レベルのGrok 4.6 とKimi K3 を比較。Grokは全テストを約20分、$15で完了し、Kimiは40分、$12かかりました。
Grok 4.6 で作ってみる1つのプロンプトでGrok 4.6 xhighとGPT-5.6 Sol Maxを比較。Grokは約23分($21.18)で完了し、Solは33分($22.53)でした。
Grok 4.6 で作ってみる1つのプロンプト、~22分間の自律作業。Grok 4.6 はカスタムシェーダー、ミニマップ、リアルタイムの時間帯変化を備えたリッチなシーンを作り上げました。
Grok 4.6 で作ってみる同じThree.jsの3Dモデリングおよび空間推論プロンプトで、Grok 4.6(Grok CLI)をKimi K3 およびDeepSeek V4 Proと対決させ、出力を比較しました。
Grok 4.6 で作ってみるGrok 4.6(Grok Code)とKimi K3(Kimi CLI)でレトロなマリオ風プラットフォーマーを作成。Grokの方が速く~11分で完了しましたが、出力の質はKimiがわずかに優れていました。
Grok 4.6 で作ってみる3つのフロンティアモデルでFlappyBenchを実施。Grok 4.6 がわずか$0.095で9.5/10を記録し、GPT-5.6 SolとOpus 5 を上回ってグループのトップとなりました。
Grok 4.6 で作ってみる定番のNYC都市レンダリングプロンプトをGrok 4.6 で実行。4.5から大きく進化し、実際の密度感、照明の灯った窓、本物らしいスカイラインが表現されました。
Grok 4.6 で作ってみる『指輪物語』の冒頭段落をThree.jsでワンショットレンダリング。Grok 4.6 Highは音声にKokoro-82Mまで取り入れました。
Grok 4.6 で作ってみるGrok 4.6 xhighでリアルタイムのガルガンチュア・ブラックホールシミュレーションをワンショット生成。レンズ効果、ドップラーディスク、フォトンリングを備えたブラウザ上のシュヴァルツシルト・レイトレーサーです。
Grok 4.6 で作ってみるGrok 4.6 とは?
Grok 4.6はxAIの最も高性能な大規模言語モデルで、2026年8月12日にGrok 4.5の後継としてリリースされました。Artificial Analysis Intelligence IndexではGPT-5.6 Solと61で並び、Fable 5には62ポイント差で、長時間稼働するエージェントや、より高度なインタラクティブおよびビジュアル作業向けに調整されています。複雑で複数のステップからなるリサーチ、分析、コードベースのタスクでも集中力を維持します。
Grok 4.6 は 500,000-token のコンテキストウィンドウを備え、テキストと画像の入力に対応し、知識カットオフは 2026年2月 です。Happycapy では単なるチャットボックスではなく、安全なクラウドサンドボックス内のエージェントを動かし、コードの記述、実行、レンダリング、ツールの操作、完成した成果物の提供まで、ローカル環境のセットアップなしに、1つのプロンプトから実行できます。
Grok 4.6 のベンチマーク性能は?
Grok 4.6 をFable 5、GPT-5.6 Sol、Grok 4.5 と、Artificial Analysis Intelligence Index、GDPVal-AA、DeepSWE 1.1、CursorBench 3.2、FrontierCode 1.1 で比較します。タブを切り替えて各評価をご覧ください。
競合の数値は、各開発元が公開しているシステムカードまたはベンチマークリーダーボードから引用しています。
出典: xAI — Grok 4.6
評価
| Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Fable 5 Max | |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54% | 73% | 70% |
| FrontierCode v1.1(Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB(Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
各評価における最高スコアは太字で表示しています。サードパーティモデルのスコアは、自己申告または公開されている結果のうち最も良いものです。
Grok 4.6 が得意なこと
長時間稼働するエージェント
リサーチ、分析、コードベース作業といった長時間・多段階のタスクにおいて、話の筋を失うことなく自己テストと進捗の検証を行います。
野心的なインタラクティブ・ビジュアル作業
ビジュアルおよびインタラクティブなプロジェクトで、より強力な初回パスを生成し、アプリケーションの構造を1回の反復で確立するのに優れています。
エージェント型コーディング
トップクラスのコーディングスコア(CursorBench 69.9%、DeepSWE 65.9%、FrontierCode 61.3%)を持ち、自律的なマルチファイル構築ループに適しています。
高速なフロンティア級推論
Artificial Analysis Intelligence IndexでGPT-5.6 Solと61で同点となり、Fable 5 の62にわずかに次ぐ位置につけながら、高速かつトークン効率も維持しています。さらに高速なプレミアム版も利用可能です。
Grok 4.6 はどんな人に向いている?
開発者とエージェントビルダー
自律的なマルチファイルコーディングループを実行し、長いタスクでも品質を維持するフロンティア級の出力を求める人向けです。
プロダクト・アプリビルダー
1つのプロンプトをインタラクティブなアプリやツールに変える、強力な初回パスの構造力を活かすメイカー向けです。
スタートアップと個人ビルダー
知能、速度、トークンコストのすべてが同時に重要になるMVPやデモの構築向けです。
クリエイティブテクノロジスト
コードとビジュアルの橋渡しをする人向けです。ジェネラティブグラフィックス、インタラクティブシーン、データ量の多いインターフェースなどに活用できます。
Grok 4.6 に関するFAQ
Grok 4.6 はGrok 4.5 と比べて何が新しいのですか?+
Grok 4.6は、2026年8月12日にリリースされたxAIのより新しく、より高性能なモデルです。推論と技術的な概念に関して厳選されたモデル生成データによる拡張的な追加学習を受け、SFT軌跡はGrok 4.5を用いて再生成され、フィルタリングも改善されています。実際には、長時間タスクにおける自己テストと検証がより強力になり、ビジュアルやインタラクティブなプロジェクトでの初回出力の質が向上し、単一のイテレーションでアプリケーションの構造を確立する能力も向上しています。
Grok 4.6 はどれくらい知能が高いのですか?+
Artificial Analysis Intelligence IndexでGrok 4.6 は61を記録し、GPT-5.6 Solと同点で、Fable 5 の62からわずか1ポイント差につけています。コーディングおよびエージェント関連の結果も強力で、CursorBench v3.2 で69.9%、DeepSWE v1.1 で65.9%、FrontierCode v1.1 で61.3%、GDPVal-AA v2 で1753を記録しています。
Grok 4.6 のコンテキストウィンドウはどれくらいの大きさですか?+
Grok 4.6 は 500,000-token のコンテキストウィンドウを備え、テキストと画像の両方の入力を受け付け、出力はテキストのみです。知識カットオフは 2026年2月 です。
Grok 4.6 の利用にはどのくらいのコストがかかりますか?+
xAIはGrok 4.6の価格を、入力トークン100万個あたり$2、出力トークン100万個あたり$6としています(キャッシュされた入力は100万個あたり$0.50)。200Kトークン以上のプロンプトは、より高い$4 / $12の料金帯で課金され、より高速なプレミアムバリアントは2倍の料金になります。Happycapyでは、Grok 4.6は有料プランのプレミアムモデルです。まずは無料アカウントを作成してプラットフォームを試し、その後アップグレードして実行できます。
Grok 4.6 は単独で完全なアプリを構築できますか?+
はい、それはまさに中心的な使用例です。計画を立て、コードを書き、実行し、自律的に反復する長時間稼働エージェント向けに調整されており、特にアプリの構造を初回パスで確立するのに優れています。Happycapy上では安全なクラウドサンドボックス内で動作し、1つのプロンプトを完成した実行可能な成果物へと変換します。
Grok 4.6 はどこで使えますか?+
発売当初、xAIはCursor、Grok、APIコンソール、OpenRouter、Vercel、CloudflareでGrok 4.6 を利用可能にしました。Happycapyではブラウザ内エージェントを動かすエンジンとして動作するため、APIキーやローカルセットアップなしでエージェント型の構築ワークフローを利用できます。
HappycapyでGrok 4.6を使ってどんなプロジェクトを作れますか?+
野心的なインタラクティブ・ビジュアル制作、ブラウザゲーム、3D空間のワールドやシミュレーション、複数ページのウェブサイト、より大きなコンテキストを活かした長時間稼働のエージェント型タスクなど。Happycapyのユースケースギャラリーには、開いてリミックスできる実際の作品が集められています。
HappycapyでGrok 4.6を実行するにはどうすればいいですか?+
このページのプロンプトボックスにタスクを入力してください。モデルは既にGrok 4.6に設定されているので、送信するだけです。Happycapyが安全なクラウドサンドボックスを立ち上げ、Grok 4.6がタスクを最初から最後まで構築、コーディング、またはレンダリングし、結果を届けます。インストールやAPIキーは不要です。
今すぐGrok 4.6 で作ってみる
無料アカウントを作成してHappycapyを試し、その後アップグレードしてxAIの最も知能の高いモデルを実際のタスクに活用しましょう。ブラウザだけで、セットアップは不要です。
無料で始める