HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

Grok 4.7

Grok 4.7 (x.ai)

276 pointsby meetpateltech216 コメント

要約

SpaceX AIは、コーディングと知識作業に特化した最新のAIモデル「Grok 4.7」を発表しました。Grok 4.6と比較して、処理速度は2倍、価格は半額でありながら、より困難なタスクを長時間処理し、自己検証能力と安全性が向上しています。複数のベンチマークで競合モデルを上回る性能を示し、特にコーディングタスクや専門的な知識作業において高いコストパフォーマンスと安全性を実現しています。

全文翻訳

ニュースに戻る 2026年9月21日 Grok 4.7の紹介 SpaceX AI コーディングと知識作業のための最も強力なモデル。 同等モデルの半額で2倍の速さ。 無料で試す Grok 4.7で構築を開始する Grok 4.7は、コーディングと知識作業において最も有能なモデルです。困難なタスクに長時間取り組み、自己の作業をより注意深く検証し、これまでにない最高のキャリブレーションされたセーフガードを備えています。Grok 4.6と同じ価格と速度で提供され、そのクラスで非常に競争力があります。 Fable 5.1、Opus 5、Grok 4.7、GPT-5.6 Sol、Sonnet 5のスコアとタスクあたりの平均コストを比較する散布図と折れ線グラフ。 55% CursorBench 4.0 スコア 50% 45% 40% 35% 30% 25% 20% $18 $15 $12 $9 $6 $3 $0 タスクあたりの平均コスト Fable 5.1 Opus 5 GPT-5.6 Sol Sonnet 5 Grok 4.7 コスト トークン ステップ CursorBench 4.0では、長時間実行されるコーディングタスクを重視しており、Grok 4.7は価格性能の最前線にいます。 モデルの改善 Grok 4.7は、Grok 4.6と比較して、新しくより大きなベースモデルを使用しています。完了までに数時間かかる問題に重点を置いた、より困難なタスクのミックスで、より長い強化学習実行でトレーニングされました。モデルは、自己の作業を検証し、より長いコンテキストを管理する能力が向上しています。また、Grok 4.7はGrok Botハーネスをネイティブに理解するようにトレーニングされており、会話タスクと一般的な知識作業の能力が向上しています。 Grok 4.7 xHigh Grok 4.6 High GPT-5.6 Sol Max Fable 5.1 Max 入力トークン価格 $100万あたりドル $2 $2 $4 $10 出力トークン価格 $100万あたりドル $6 $6 $20 $50 ソフトウェアエンジニアリング CursorBench 4.0 46.3% 40.4% 41.7% 51.8% ソフトウェアエンジニアリング DeepSWE v1.1 71.0% *65.2% 72.7% 70.0% 電気工学 EEBench 64.0% 53.0% 39.4% 56.4% 数時間におよぶオフィスワーク AA Briefcase v1.1 1,657 1,546 1,487 1,678 数時間におよぶターミナルワーク Terminal-Bench 4.0 38.0% 20.3% 37.3% 57.9% 法律業務 Harvey Legal Agent Benchmark 19.6% 15.8% 2.5% 6.7% 臨床推論 HealthBench Professional 56.7% 48.5% 60.5% 62.1% *高負荷 Grok 4.7、Grok 4.6、GPT-5.6 Sol、Fable 5.1のトークン価格とベンチマークスコア。ベンチマークはCursorBench 4.0、DeepSWE v1.1、EEBench、AA Briefcase v1.1、Terminal-Bench 4.0、Harvey Legal Agent Benchmark、HealthBench Professionalです。Grok 4.7 DeepSWEのアスタリスクは高負荷スコアを示します。 Grok 4.7は、ドキュメントやプレゼンテーションの作成において優れています。GDPvalとAA Briefcaseでは、AIは弁護士、看護師、金融アナリストなどの専門家が行うタスクに取り組むように求められます。Grok 4.7は両方のベンチマークでGrok 4.6を改善し、他の最先端モデルと同等のパフォーマンスを発揮します。 専門的な知識作業 数時間におよぶオフィスワーク 電気工学 専門的な知識作業 GDPval 0 500 1000 1500 Eloスコア 1735 Fable 5.1 (max) 1695 Grok 4.7 (xhigh) 1605 Grok 4.6 (high) 1542 GPT-6 Astra (max) GDPval、AA Briefcase、EEBenchスコアをGrok 4.7、Grok 4.6、Fable 5.1、GPT-6 Astraと比較。 安全性とサイバーセキュリティ Grok 4.7は、完全に新しいセーフガードスタックで構築されました。拒否とジェイルブレイク耐性において、当社がテストした中で最も強力なモデルです。サイバーセキュリティや生物学的作業のようなデュアルユースドメインでは、無害なタスクの有用性と危険なタスクの安全な拒否の両方においてリードしており、LatchBioのバイオセーフティベンチマークで62.4%を記録しました。Grok 4.7は、強力なサイバー防御能力と、正当な使用に対する低い拒否率のバランスを取っています。当社のリスクと悪意のあるサイバータスクのベンチマークであるHackerBench v0.3で最高の安全性を発揮し、リスクのあるデュアルユースプロンプトの3.3%しか通過させず、正当なセキュリティ作業をブロックすることはめったにありません。また、一部のサイバーセキュリティパートナーに、防御研究のためのGrok 4.7のレッドチーム機能への招待制アクセスを提供し始めています。 価格と利用可能性 Grok 4.7は、本日CursorとGrok Buildで利用可能です。また、Grok API、サードパーティのコーディングハーネス、モデルルーター、クラウドプラットフォームを通じて利用できます。モデルの価格は、入力トークン100万あたり2ドル、出力トークン100万あたり6ドルから始まります。また、出力速度が2倍で価格も2倍の高速バリアントも提供しています。 コンソール APIキーを作成する docs.x.ai ドキュメントを読む Grok Buildで無料で試す x.ai/buildで今日から始めましょう。 $ curl -fsSL https://x.ai/cli/install.sh | bash