ステップごとのモデルルーティング
各プロンプトやステップごとにどのモデルを使うべきかを予測し、エージェントのワークフロー全体で品質とコストのバランスを取れるようにします。
Not Diamondは、コーディングエージェント向けのインテリジェントなモデルルーターです。各プロンプトやステップごとに最適なAIモデルを選択し、品質向上とコスト削減を支援。既存のゲートウェイやハーネス基盤と連携し、プライバシー保護と企業向け導入にも対応します。
Not Diamondは、コーディングエージェント向けのインテリジェントなモデルルーターです。各プロンプトやステップごとにどのAIモデルを使うべきかを予測し、長期的なエージェントワークロードに取り組むエンジニアリングチームの品質向上とコスト削減を支援することを目的としています。
この製品はゲートウェイそのものとしてではなく、既存のハーネスやゲートウェイ基盤と連携する安全な統合レイヤーとして位置づけられています。サイトでは、本番運用向けのワークフローに対応し、利用シグナルから継続的に学習し、ペイロードデータをローカルに保持する必要があるチーム向けにプライバシー保護型のルーティングオプションを提供すると説明されています。
各プロンプトやステップごとにどのモデルを使うべきかを予測し、エージェントのワークフロー全体で品質とコストのバランスを取れるようにします。
ペイロードの意味情報、KVキャッシュの状態、暗黙的なフィードバック、セッション結果、サブエージェントの構成、コンパクションイベント、過去のターンなどのシグナルを使って推奨を行います。
既存のゲートウェイ基盤を置き換えるのではなく連携し、安全なAPIを通じてスタックに依存しない設計として説明されています。
ハーネスの利用状況やセッション結果から継続的に学習し、強化学習を用いて時間とともに推奨精度を改善します。
派生したリクエストメタデータとローカルで計算された特徴量に基づく、プライバシー保護型のルーティングを提供し、ペイロード、入力、出力は参照しません。
組織全体の分析機能に加え、エンタープライズ向けの高度なセキュリティと管理機能、MDM展開、SAMLによるSSO、SLA、24時間365日のサポートを提供します。
手動で各ステップのモデルを選ばずに、コーディングエージェントのワークフロー全体で推論コストを下げたい場合にNot Diamondを使います。
エージェントの品質が重要で、ルーティング判断にプロンプトの文脈、キャッシュ状態、過去のターン、セッション結果を反映させたい場合に使います。
すでにゲートウェイとハーネスを導入済みで、ルーティングをそれらの置き換えではなく構成の一部として組み込みたい場合に使います。
機密性の高いワークロードでプライバシー保護型ルーティングが必要であり、生データではなく派生メタデータに基づいて判断したい場合に使います。
組織単位で集約された分析、管理機能、SSO、MDM展開のサポート、ルーティング基盤に関するSLAが必要な場合に使います。
インテリジェントなモデルルーティングとは、各プロンプトに対してどのAIモデルを使うかを予測し、チームがコストを抑えながら精度を向上させるための仕組みです。Not Diamondはこの手法をコーディングエージェントのワークフローに適用します。
いいえ。料金ページでは、Not Diamondはゲートウェイではないと説明されています。既存のゲートウェイ基盤と連携し、お使いのモデルゲートウェイやハーネスと組み合わせて動作します。
この製品は、長期にわたるコーディングエージェントのワークロード向けに特化して設計されており、さまざまなコーディングエージェントのハーネスと連携できます。料金ページでは、カスタムのハーネス統合要件についてはチームに相談できるとも案内されています。
はい。料金FAQでは、Not DiamondはClaude Codeで動作し、Anthropicモデルのみと組み合わせて使用する場合はAnthropicの商用利用規約に適合すると記載されています。
料金ページによると、Not Diamondを使うチームは、最先端モデルと比べて品質を損なうことなく、少なくとも20〜40%のコスト削減を実現し、場合によってはそれ以上の削減も可能です。また、ルーターは1ステップあたり平均で約100〜200ミリ秒の遅延を追加すると説明されています。