Mercury 2 logo

Mercury 2

認証する

Mercury 2 is Inception’s diffusion-based reasoning language model for production AI workflows that need low latency, OpenAI API compatibility, and structured output support. It is aimed at coding, agentic, voice, and retrieval-heavy applications.

Mercury 2 preview

Mercury 2 とは

Mercury 2 は、自己回帰的デコーディングではなくディフュージョンに基づいて構築された、Inception の最速の推論言語モデルです。厳しいレイテンシ予算の中でも推論レベルの品質を必要とするチーム向けの、プロダクション志向の LLM として位置づけられています。

この製品は、コーディングアシスタント、エージェントループ、音声インターフェース、検索パイプラインなど、複数ステップにわたってレイテンシが積み重なるワークフローを対象としています。Inception は、Mercury 2 は API とチャット体験を通じて現在利用可能であり、既存のスタックへの導入を容易にするために OpenAI API 互換であると述べています。

主な機能

ディフュージョンベースの推論

Mercury 2 は、左から右へのトークンデコードではなくディフュージョンベースの生成を使用し、少数のステップで並列に出力を洗練します。

高スループット生成

モデルページでは、Mercury 2 は商用 NVIDIA GPU 上で毎秒 1,000 トークン超で動作すると説明されており、ローンチ投稿では NVIDIA Blackwell GPU 上で毎秒 1,009 トークンとされています。

そのまま使える API 互換性

このモデルは OpenAI API 互換として提示されており、既存の LLM ワークフローのドロップイン代替として使用できます。

本番運用向けの出力制御

Inception は、本番ワークフロー向けに、調整可能な推論、128K コンテキストウィンドウ、ネイティブなツール利用、スキーマに整合した JSON 出力を挙げています。

レイテンシ重視の設計

ローンチ投稿では、Mercury 2 は高い同時実行時でも p95 レイテンシ、ターン間の挙動、スループットを安定させるよう設計されているとしています。

汎用推論モデル

Inception は Mercury 2 を、パフォーマンスと速度の両方が重要な複雑なアプリケーション向けの最も強力なモデルとして位置づけています。

Mercury 2 の適用領域

  • コーディングと編集

    オートコンプリート、次編集の提案、リファクタリング、対話型コーディングエージェント向けに、Mercury 2 は開発者の作業の流れを保てる程度に応答性の高い提案を提供するよう位置づけられています。

  • エージェントループ

    サブエージェントやキャンペーン最適化のように、多くの推論呼び出しを連鎖させるワークフローでは、1 回あたりのレイテンシが低いことで、実用的に実行できるステップ数が変わります。

  • リアルタイム音声と対話

    音声インターフェースやリアルタイム会話システム向けに、Inception は Mercury 2 を、テキスト生成を自然な発話のリズムに合わせる手段として位置づけています。

  • 検索および RAG パイプライン

    マルチホップ検索、再ランキング、要約パイプラインでは、Mercury 2 はエンドツーエンドのレイテンシを実用的な範囲内に保ちながら推論を追加できます。

Pros and Cons

Pros

  • レイテンシが各ステップで重要になる、リアルタイムまたはほぼリアルタイムのアプリケーション向けに設計されています。
  • 逐次デコードではなく、ディフュージョンベースの生成により複数トークンを並列に生成します。
  • 調整可能な推論、ツール利用、構造化 JSON 出力、128K コンテキストウィンドウをサポートします。
  • OpenAI API 互換として提示されており、既存チームの移行作業を減らせる可能性があります。
  • コーディング、エージェント、音声、検索ワークフローにまたがる文書化されたユースケースがあります。

Cons

  • 公開価格ページは利用できなかったため、サイトの価格参照以外のプラン詳細はソースページ上で完全には文書化されていません。
  • ソース資料には、正式な統合ディレクトリやデプロイメントマトリクスは記載されていません。

FAQ

チームは Mercury 2 をどのように利用できますか?

Mercury 2 は、Inception の API とチャットインターフェースを通じて現在利用可能です。サイトでは OpenAI API 互換でもあるとされており、既存のスタックに書き換えなしで組み込めます。

Mercury 2 はどのような用途に最適ですか?

Inception は Mercury 2 を、コーディングと編集、エージェント型ワークフロー、リアルタイム音声と対話、検索または RAG パイプラインのようなレイテンシ重視の作業向けに位置づけています。

製品ページではどのような機能が説明されていますか?

製品ページでは、調整可能な推論、128K コンテキストウィンドウ、ネイティブなツール利用、スキーマに整合した JSON 出力が挙げられています。また、ディフュージョンベースの並列的な洗練による高速生成も強調されています。

サイトではどのような価格オプションが示されていますか?

サイト上の価格ページは利用できませんでしたが、モデルページでは Free、Developer、Enterprise の利用経路が示されています。Free には全モデルへのアクセスと 1,000 万無料トークンが含まれ、Developer は従量課金、Enterprise はカスタムレート制限、SLA 保証、セキュリティとプライバシー、ボリュームベースの価格設定が追加されます。

どのような統合が文書化されていますか?

ソース資料には正式な統合カタログは記載されていません。ただし、Mercury 2 は OpenAI API 互換であり、AISuite、LiteLLM、LangChain を含むライブラリでサポートされていると記載されています。

Quick Facts

カテゴリ
AI モデル / 開発者ツール
製品
Mercury 2
会社
Inception
プラットフォーム
API とチャット
互換性
OpenAI API 互換
コンテキストウィンドウ
128K

Mercury 2 の分析

Mercury 2· 月間訪問数 18.4万· 世界ランキング #250,393

トラフィックデータは参考情報としてご利用ください。

月間訪問数
18.4万
世界ランキング
#250,393
カテゴリ順位
#46
直帰率
43.3%
平均滞在時間
00:46
訪問あたりのページ数
2.21

トラフィック推移

43.4万28.9万14.5万03月: 434,1183月4月: 241,5074月5月: 183,5935月
月間訪問数 - 3
3月434118
4月241507
5月183593

トラフィックソース

  • 直接流入49.1%
  • 検索33.7%
  • 参照元8.35%
  • ソーシャル4.32%
  • メール2.20%
  • ディスプレイ広告0.08%

主な地域

  • アメリカ合衆国21.8%
  • インド14.9%
  • インドネシア5.37%
  • ブラジル3.54%
  • アラブ首長国連邦2.49%
  • その他52.0%