実行戦略
ホームページでは、推論時にスケーリング手法を適用してエージェントの性能限界を向上させる実行戦略を中心に構築されたシステムとして説明されています。
AI21は、企業向けの基盤モデルとAIシステムを提供し、本番AIワークフローを支援します。従量課金、無料トライアル、拡張向けの個別プランに対応。
AI21は、本番AIワークフローを実行したい企業チーム向けに基盤モデルとAIシステムを構築しています。ホームページでは、エージェント、長文コンテキストモデル、コスト、精度、レイテンシーのためのシステムレベル最適化を軸にプラットフォームを紹介しています。
製品資料では、長文コンテキスト処理向けの Jamba モデルと、本番エージェント向け最適化フレームワークとしての Maestro という2つの主要領域が強調されています。サイト全体を通じて、AI21 はルーティング、ハーネス最適化、トークンの可視性、カスタム企業向け導入のサポートといった測定可能な実行の選択肢を中心にスタックを位置づけています。
ホームページでは、推論時にスケーリング手法を適用してエージェントの性能限界を向上させる実行戦略を中心に構築されたシステムとして説明されています。
AI21は、複数の選択肢の中から最適なモデルとハーネスの組み合わせを自動的に見つけられるため、手動の調整作業を減らせると説明しています。
インテリジェントなモデルルーティングは、モデルのアンサンブル全体にわたって呼び出しを動的に振り分け、品質を維持しながらコスト削減を支援します。
ホームページと営業問い合わせページの両方で、Jamba は長文コンテキスト処理とトレーニング重視の作業向けのモデルラインとして紹介されています。
システム基盤のセクションでは、トークンの使用量を把握し、AIへの投資を最適化できるようにトークンの可視性が重視されています。
同じくシステム基盤のセクションでは、正確性と適応性も強調されており、信頼性の高い出力を提供し、チームの環境や入力から時間とともに学習できるように設計されたスタックであると説明されています。
コスト、精度、レイテンシーについて本番環境向けの最適化が必要なAIエージェントを構築する際に AI21 を使用します。
ドキュメントが多い処理や複数ステップの言語タスクなど、長文コンテキスト処理が必要なワークフローには Jamba モデルを使用します。
チーム、リポジトリ、エージェント全体のトークン支出を把握・管理したい場合にプラットフォームを使用します。
基盤となるコードを変更せずに既存のエージェントワークフローの効率を改善したい場合は Maestro を使用します。
AI21は、企業向けワークフローのための基盤モデルとAIシステムを提供します。製品資料では、エージェント、長文コンテキスト処理、本番環境向けの最適化に重点を置いています。ホームページでは、実行戦略、ハーネス最適化、インテリジェントなモデルルーティング、Jamba モデルのトレーニングなどのAIスタック要素が紹介されています。
料金ページでは、7日間で10ドル分のクレジットが付与される無料トライアルがあり、その後は従量課金制となっています。AI21は、拡張サポート、プライベートクラウドホスティング、優先サポート、専任アカウントマネージャー、AIコンサルティングが必要な企業向けにカスタムプランも提供しています。
AI21の料金ページでは、基盤モデルの料金として Jamba Mini と Jamba Large が掲載されており、各モデルは異なるタスク範囲に対応する効率的な長文コンテキストモデルとして説明されています。
問い合わせページでは、Maestro は本番AIエージェント向けの最適化フレームワークとして位置づけられています。Maestro は、コードを変更せずにリクエストを実行中にルーティング、圧縮、分解し、チーム、リポジトリ、エージェントごとの支出配分を支援すると説明されています。
ソース資料には、統合一覧やSDKの対応範囲は詳しく記載されていません。基盤モデルのAPIやSDKへの言及はありますが、対応プラットフォームやワークフロー統合の詳細は示されていません。