HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

Step 5 Preview、StepFunによる1MコンテキストのMoEがOpenRouterに登場

Step 5 Preview, a 1M-context MoE from StepFun, shows up on OpenRouter (openrouter.ai)

15 pointsby AnneWodell6 コメント

要約

StepFunが開発した「Step 5 Preview」は、600Bパラメータ(アクティブ27B)のスパースMixture-of-Experts(MoE)アーキテクチャに基づく、エージェントワークに特化したフラッグシップモデルです。特にソフトウェアエンジニアリング、専門知識、金融分野で高い性能を発揮し、100万トークンのコンテキストウィンドウを備えています。このモデルは、ツールを使用し、複数ステップで結果を洗練させながら、大規模なコードベースやドキュメントにまたがる長時間のタスクを処理するように設計されています。

全文翻訳

サインアップ サインアップ StepFun: Step 5 Preview stepfun/step-5-preview 比較 API このモデルを試す Step 5 Previewは、StepFunのエージェントワークのためのフラッグシップモデルであり、スパースなMixture-of-Expertsアーキテクチャ(アクティブ27B / 合計600Bパラメータ)に基づいています。ソフトウェアエンジニアリングと専門知識を要する業務において高いパフォーマンスを発揮し、特に金融分野に強みを持っています。ツールを使用し、複数ステップで結果を洗練させながら、大規模なコードベースやドキュメントにまたがる長時間のタスクを処理するように設計されています。 モダリティ 入力 / 出力 価格 1ドル / 2.70ドル 1Mあたり コンテキスト 1.0M リリース日 2026年10月8日 StepFun: Step 5 Preview 比較 API このモデルを試す プロバイダー プロバイダー このモデルは1つのプロバイダーによってホストされています。OpenRouterはすべてのリクエストを直接転送します。ルーティングの決定は必要ありません。 価格 プロバイダーが提示する価格の隣にある、顧客が実際にこのモデルに支払う平均価格。キャッシュと割引により、実際に支払われる価格は表示価格を大幅に下回ることがよくあります。 パフォーマンス スループットはモデルの書き込み速度(トークン/秒、高いほど良い)です。レイテンシは総往復時間(低いほど良い)です。TTFTはTime-to-First-Tokenで、何か表示されるまでの時間(低いほど良い)です。 稼働時間 稼働時間は、過去3日間のうち、少なくとも1つのプロバイダーがリクエストに応答していた時間の割合です。可用性は、推論が正常に提供された時間の割合です。OpenRouterは、プロバイダーがエラーを返した場合、継続的に監視し、次に最適なプロバイダーを使用します。 アプリ このモデルに最も多くのトラフィックを送信する公開アプリ。実際のプロダクションワークロードがどのようなものかを示す良い指標であり、このモデルが最も適しているユースケースのヒントになります。 アクティビティ このモデルへのトークン量とリクエストトラフィックの経時変化。 API モデルを呼び出すためのドロップインコード。OpenRouterのAPIはOpenAI互換なので、ほとんどのSDKはベースURLを変更するだけで動作します。モデル間で変更されるのは、以下のモデルスラッグだけです。 他のモデルを探す ビジョン対応AIモデル:画像理解のためのマルチモーダルLLM コレクション AIモデルランキング ランキング 推論負荷 すべて レイテンシ / スループット P50 プロバイダー 入力 / M 出力 / M キャッシュ読み取り / M レイテンシ スループット 稼働時間 StepFun 1.00ドル 2.70ドル 0.05ドル 3.48秒 99 tps 100.00% スループット 99トークン/秒 P50、プロバイダー全体で最高 レイテンシ 3.48秒 P50、最高プロバイダー すべての場所 推論負荷 すべて 3日間 稼働時間(3日間) モデルは到達可能でした。プロバイダーにルーティングされました。 99.98% 可用性(3日間) モデルはいずれかのプロバイダーから推論を返しました。エラーと空の応答は対象となります。 99.66% 過去3日間の可用性 過去72時間 可用性 99.66% 3日前 2日前 昨日 現在 過去24時間の可用性 OpenRouter 可用性 99.73% アップストリームプロバイダーでエラーが発生した場合、リクエストフィルターが許可していれば、別の正常なプロバイダーにルーティングすることで回復できます。エンドポイントAPIを通じて、プロバイダーごとの稼働時間データをプログラムで取得できます。ロードバランシングとカスタマイズオプションの詳細をご覧ください。 1. OpenClaw OpenClawは、メッセージングアプリに接続し、コマンドの実行、ウェブの閲覧、ファイルの管理、メールの送信など、あなたの代わりに実際の操作を行うオープンソースAIエージェントです。 79.6Bトークン 2. Hermes Agent Hermes Agentは、Nous Researchによるオープンソースの自己改善AIエージェントで、セッション間で永続的にメモリを持ち、経験から再利用可能なスキルを構築します。ウェブ検索、ブラウザ自動化、ビジョンを含む40以上の組み込みツールに加え、スケジュールされた自動化やサブエージェントを備えています。 6.11Bトークン 3. Kilo Code Kilo Codeは、VS Code、JetBrains、CLIで動作するオープンソースのAIコーディングエージェントで、エージェントワークフローで開発者がより速くコードを出荷できるよう支援します。 950Mトークン 4. Nous Research API Nous Researchは、オープンソースAIの進歩に焦点を当てたAI研究チームです。 320Mトークン 5. Claude Code Claude Codeは、Anthropicのエージェント型コーディングツールで、コードベース全体を読み取り、自然言語プロンプトからファイル間の変更を計画・実行し、テストを実行し、失敗を繰り返します。 192Mトークン よくある質問 Step 5 Previewとは何ですか? Step 5 Previewは、StepFunのエージェントワークのためのフラッグシップモデルであり、スパースなMixture-of-Expertsアーキテクチャ(アクティブ27B / 合計600Bパラメータ)に基づいています。ソフトウェアエンジニアリングと専門知識を要する業務において高いパフォーマンスを発揮し、特に金融分野に強みを持っています。ツールを使用し、複数ステップで結果を洗練させながら、大規模なコードベースやドキュメントにまたがる長時間のタスクを処理するように設計されています。 Step 5 Previewの料金はいくらですか? Step 5 Previewは、入力トークン1Mあたり1.00ドル、出力トークン1Mあたり2.70ドルで、キャッシュ読み取りはトークン1Mあたり0.05ドルと別途料金がかかります。 Step 5 Previewのコンテキスト長はどれくらいですか? Step 5 Previewは、1,000,000トークンのコンテキストウィンドウを持っています。最大64,000の完了トークンをサポートします。 Step 5 Previewはツール呼び出しと構造化出力をサポートしていますか? はい。Step 5 Previewは、関数呼び出しのためのツールを受け入れます。また、response_format内のJSONスキーマを介して構造化出力をサポートします。 Step 5 Previewはどのような入力と出力をサポートしていますか? Step 5 Previewは、テキスト、画像、ビデオを入力として受け取り、テキストを返します。 StepFunには他にどのようなテキストモデルがありますか? Step 3.7 FlashとStep 3.5 FlashはStepFunの他のテキストモデルです。 Step 5 Previewはいつリリースされましたか? Step 5 Previewは2026年10月8日にリリースされました。 StepFunのその他のモデル Step 3.7 Flash Step 3.7 Flashは、StepFunの最新の高効率マルチモーダルMixture-of-Expertsモデルです。196Bパラメータの言語バックボーンとビジョンエンコーダーをペアにして、ネイティブな画像とビデオの理解を実現し、トークンあたり約11Bパラメータをアクティブにします。このモデルは256Kのコンテキストウィンドウをサポートし、選択可能な推論レベル(高/中/低)を提供し、呼び出し元が速度、コスト、推論の深さをトレードオフできるようにします。コーディング、エージェントワークフロー、構造化出力、長コンテキスト生産性タスク向けに設計されています。 テキスト 262Kコンテキスト 0.20ドル / 1.15ドル Step 3.5 Flash Step 3.5 Flashは、StepFunの最も有能なオープンソース基盤モデルです。スパースなMixture of Experts(MoE)アーキテクチャに基づいており、196Bパラメータのうちトークンあたり11Bパラメータのみを選択的にアクティブにします。これは、長コンテキストでも非常に高速な推論モデルです。 テキスト 262Kコンテキスト 0.10ドル / 0.30ドル 前のスライド 次のスライド