AI・機械学習
Muse Spark 1.1 のご紹介
Introducing Muse Spark 1.1 (ai.meta.com)
要約
Metaは、エージェントタスク向けに設計されたマルチモーダル推論モデルであるMuse Spark 1.1を発表しました。このモデルは、ツール使用、コーディング、マルチモーダル理解において大幅な改善を遂げており、開発者向けに新しいMeta Model APIを通じて公開プレビューが提供されます。Muse Spark 1.1は、複雑なプロジェクトを迅速に処理し、100万トークンのコンテキストウィンドウを管理する能力を持ち、安全性評価も徹底されています。
全文翻訳
ProductsAI ResearchResourcesAboutTry Meta AIIntroducing Muse Spark 1.1July 9, 2026•10 minute read本日、Meta Superintelligence Labsの最新モデルであり、Muse Sparkからの大幅なアップグレードであるMuse Spark 1.1を発表できることを嬉しく思います。Muse Spark 1.1は、エージェントタスク向けに構築されたマルチモーダル推論モデルであり、ツールとコンピューターの使用、コーディング、マルチモーダル理解において大きな進歩を遂げています。
これらの改善により、Muse Spark 1.1はパフォーマンスと効率性のフロンティアを前進させます。今週のMuse Imageのローンチと合わせて、このリリースは、個人の超知能という私たちのビジョンに近づけてくれます。これは、あなたが目標を追求し、想像したものを創造し、人間関係を深め、最も価値のあるものに行動を起こすのを助けるモデルです。
このリリースと同時に、開発者がMuse Spark 1.1にアクセスできる新しいMeta Model APIのパブリックプレビューをローンチします。このモデルは現在、Meta AIアプリおよびmeta.aiで「Thinking」モードで利用可能です。
Evaluations私たちの評価の詳細については、レポートをご覧ください。
AgentsMuse Spark 1.1は、さまざまな外部アプリケーションやサービスにわたる計画とオーケストレーションを必要とする個人的なエージェントタスクにおいて、卓越したパフォーマンスを発揮します。新しいネイティブツール、MCPサーバー、カスタムスキルに対してゼロショットで一般化します。
マルチエージェントシステムをオーケストレーションしてエンドツーエンドのレイテンシーを最適化するようにトレーニングされているため、Muse Sparkよりも大幅に高速に複雑なプロジェクトを処理します。メインエージェントとして、コンテキストを収集し、計画を立て、並列サブエージェントに実行を委任できます。サブエージェントとしては、そのジョブを遵守し、利用可能なツールを理解し、いつメインエージェントにエスカレートするかを知っています。
Muse Spark 1.1は、100万トークンのコンテキストウィンドウを積極的に管理できます。アクションを記憶し、はるかに以前の作業から情報を取得し、後の作業に必要な重要なステップを維持するように圧縮します。
Computer UseMuse Spark 1.1は、複数のアプリケーションにまたがり、情報がリアルタイムで変化するコンピューター使用ワークフローに優れています。拡張セッション全体でコンテキストを維持し、進化する要件に適応し、最小限の人的介入で未知のインターフェースをナビゲートします。
すべてのデスクトップステップを1クリックずつ推論するのではなく、Muse Spark 1.1は、いつ自動化し、いつインターフェースを直接使用するかを理解します。モデルは、自動化が速い場合はスクリプトを作成し、直接操作が簡単な場合はクリックし、各ステップでアクションのバッチを生成するようにトレーニングされました。
エージェントによるディナーパーティーの整理:実際のアプリケーションでは、タスクを変更する新しいコンテキストが発生します。Muse Spark 1.1は、ディナーの注文時にこれらの変更に気づき、ユーザーの介入なしに必要な更新を行います。
CodingMuse Spark 1.1のコーディングパフォーマンスは、大規模で複雑なコードベースを伴う実際のタスクで大幅に向上しました。複雑なバグを診断および修正し、エンタープライズグレードのシステムに新機能 を実装し、大規模なコード移行を実行できます。Webアプリケーションの作成やエンドツーエンドの質問応答などのユースケースでは、Muse Spark 1.1は最初のモデルから大幅な改善を示しています。
モデルは、さまざまなハーネスにスムーズに適応し、複雑なマルチターンダイナミクスを確実に処理するようにトレーニングされました。Muse Spark 1.1は、計画モード、目標条件付け、サブエージェント委任、コンテキスト圧縮などの一般的な機能をサポートする、人気のあるエージェントコーディング設定でうまく機能します。
OpenCodeでのデバッグデモ:Muse Spark 1.1は、チャットWebアプリケーションを構築し、ユーザーが見える障害を特定するために自動スクリーンショットを撮り、関連コードに問題をトレースして修正を実装し、これらの変更を検証します。このモデルは、コーディング、マルチモーダル理解、ツール呼び出しをシームレスに組み合わせています。
Meta全体で、開発者と研究者は、より速く構築し、よりスマートに作業するために、毎日Muse Spark 1.1を使用しています。私たちの主要な内部コーディング評価であるMeta Internal Coding Benchでは、Muse Spark 1.1はMuse Sparkを大幅に改善し、主要な代替手段と競争力があります。
研究者は現在、ワークフローでMuse Spark 1.1を活用して、モデル開発と評価タスクを自動化しています。
OpenCodeでのDeepSWE評価:Muse Spark 1.1は、さまざまな推論強度にわたるDeepSWEタスクのサブセットで自身を評価し、結果に基づいた分析ダッシュボードを生成します。
Multimodalコーディングおよびエージェント機能に加えて、Muse Spark 1.1は、知覚、マルチモーダル推論、ツール使用に優れています。実際の環境と対話でき、視覚からコードへの成果物生成、超詳細な画像およびビデオキャプション、マルチモーダルユースケースのエージェントワークフロー実行における強みを持つ、グラウンデッドな出力を生成できます。
Muse Spark 1.1のマルチモーダル機能は、知覚とアクションが同時に発生する必要がある場合に特に価値があります。モデルは、視覚と音声を検査し、長いワークフロー全体で詳細を保持し、ユーザーに代わってコンピューターを操作しながらそれらの詳細を使用できます。
Facebook Marketplaceエージェント:スマートフォンで撮影されたビデオを使用して、Muse Spark 1.1は有用な写真を抽出し、製品について推論してユーザーのブラウザを操作し、ユーザーに代わってFacebook Marketplaceリスティングを作成します。
Safety展開前に、最も高度なモデルの評価、脅威モデル、および展開しきい値を定義するAdvanced AI Scaling Frameworkに従って、広範な安全評価を実施しました。
すべてのフロンティアリスクカテゴリ(化学・生物、サイバーセキュリティ、制御喪失)において、私たちの評価ではMuse Spark 1.1が安全な範囲内で動作していることが示されています。Muse Spark 1.1は、直接的なジェイルブレイクや、信頼できないデータ、プロンプトインジェクション、開発者プロンプト攻撃からの間接的な攻撃に対して強力な耐性を示します。その結果、より優れた敵対的ロバスト性、低い幻覚率、および減少したシコファンシーを示します。
1.1の完全な安全体制は、Muse Spark 1.1評価レポートに文書化されています。
Availability初めて、開発者は新しいMeta Model API(現在パブリックプレビュー中)を通じてMuse Spark 1.1で構築を開始できます。Muse Spark 1.1の初期パートナーは、このモデルを完全なエージェント基盤として高く評価しており、長大なコンテキスト処理と強力なコーディングおよび推論機能を組み合わせて、大規模なエージェントワークロードを処理します。
「Muse Sparkの最も印象的な点は、1つのモデルにこれほど多くのものを詰め込んでいることです。巨大な100万トークンのコンテキスト、完全なマルチモーダルサポート(画像、ビデオ、PDF)、引用付きの組み込み検索、強力な推論、トップクラスのコーディング能力(特にフロントエンドとデザイン)、構造化出力、および並列ツール呼び出し。すべてクリーンなOpenAI互換パッケージに収まっています。完全なエージェント基盤。」— Amjad Masad, CEO of Replit
「Metaは明らかに、真剣なエージェントコーディングのために構築しています。リアルなコーディングワークロードを大規模に実行できる価格帯での強力なツール使用。その組み合わせはまれであり、 Cline開発者が早期にアクセスできるようになったまさにその理由です。」— Saoud Rizwan, CEO of Cline
「Boxのエンタープライズワーク評価セットに対してテストしたところ、Muse Sparkは今日の主要なフロンティアモデルに匹敵するエンタープライズ機能を提供しました。そのレベルのインテリジェンスは、プロフェッショナルサービス、公共部門、産業オペレーションなどの業界における構造化された手順ワークフローでの強みと組み合わさることで、組織にとって魅力的な選択肢となります。」— Yashodha Bhavnani, VP of AI Products at Box
私たちは、研究の勢いの証であるMuse Spark 1.1をリリースできることを嬉しく思います。さらに能力の高いモデルをトレーニング中であり、今後の発表にご期待ください。
執筆者:Meta Superintelligence LabsShare:Our approachAbout AI at MetaPeopleCareersResearchInfrastructureResourcesDemosMeta AIExplore Meta AIMedia GenerationVibesAI StudioLatest newsBlogNewsletterFoundational modelsLlamaOur approachOur approachAbout AI at MetaPeopleCareersResearchResearchInfrastructureResourcesDemosMeta AIMeta AIExplore Meta AIMedia GenerationVibesAI StudioLatest newsLatest newsBlogNewsletterFoundational modelsLlamaPrivacy PolicyTermsCookies Meta © 2026