AIxBlock logo

AIxBlock

認証する

AIxBlockは、音声AIとLLM向けの企業向け学習データサービスを提供。多言語テキスト、音声、セルフホスト型ワークフローで、データの収集・アノテーション・管理を支援します。

AIxBlock preview

概要

AIxBlockは、音声システムとLLM向けの企業向け学習データサービスを提供します。サイト上では、モデル学習とアラインメントのためのテキストデータ、ASRと音声AIのための音声・オーディオデータ、そしてデータを自社インフラ内に保持する必要があるチーム向けのセルフホスト型プラットフォームという3つの主要領域に整理されています。

この製品は、単発のラベリング支援ではなく、大規模な構造化データセットを必要とする組織向けに設計されています。公開されている事例には、多言語の銀行チャットデータ、コンタクトセンターの音声データ、複数ロケールのオーディオプログラムが含まれ、文字起こし、アノテーション、レビュー、管理された納品のワークフロー支援も示されています。

サイト全体を通じて、AIxBlockは多言語対応、運用上の品質管理、導入の柔軟性を重視しています。このプラットフォームは、規制対象データを扱う企業チーム、ローカルガイドラインとレビューが必要なチーム、または収集とアノテーションを自社のセキュリティ境界内で実行したいチーム向けに位置付けられています。

主要機能

LLMテキストデータワークフロー

会話アノテーション、意図分類、エンティティラベリング、RLHFの選好データ、SFTデータセット、LLM学習向けの安全性や評価ワークフローをサポートします。

音声・オーディオアノテーション

音声収集、タイムスタンプ付き文字起こし、話者ダイアライゼーション、音素アノテーション、音声システム向けの感情・センチメントラベリングに対応します。

非音声オーディオ収集

環境音、機械音、家庭内音、音響シーン、効果音、非音声オーディオモデル向けの人間のノイズをカバーします。

多言語ワークフォース

ネイティブスピーカー、言語学者、現地のSMEを活用し、ガイドラインをローカライズして100以上の言語にわたる多言語業務を支援します。

組み込み品質管理

カスタムAIモニタリング、多段階レビュー、アノテーター間一致チェック、ブラインドテスト、プロジェクトマネージャーによって、ワークフローに品質管理を組み込みます。

セルフホスト型デプロイ

オンプレミス、プライベートクラウド、ハイブリッド、エアギャップ環境など、顧客のインフラ上で運用できます。

適用領域

  • LLMの学習とアラインメント

    LLMを学習またはアラインメントするチームは、会話アノテーション、意図・エンティティラベリング、RLHFの選好データ、安全性評価データセットにテキストデータワークフローを活用できます。

  • ASRと音声モデル開発

    音声AIやボイスAIのチームは、話者ラベル、タイムスタンプ、ダイアライゼーション、ASR、TTS、音声アシスタント向けの文字起こし付き録音を収集・アノテーションできます。

  • 規制対象または主権要件のあるデプロイ

    機密データを社内に保持する必要がある組織は、セルフホスト型プラットフォームを使って、収集、アノテーション、レビューを自社インフラ内で実行できます。

  • 多言語データプログラム

    多言語対応が必要なプロジェクトでは、現地のSME、ネイティブスピーカー、レビュー管理を組み合わせて、言語、アクセント、地域差にまたがるデータセットを作成できます。

  • 非音声オーディオモデリング

    オーディオ分類器や音響モデルを構築するチームは、人間の発話以外の環境音、機械音、家庭内音、効果音を収集できます。

Pros and Cons

Pros

  • テキストと音声の両方のデータ要件を1つの製品ファミリーでカバーします。
  • テキストと音声のページで100以上の言語に対応し、企業規模の多言語業務をサポートします。
  • データを自社インフラ内に保持する必要がある組織向けに、セルフホスト型デプロイを提供します。
  • 最終レビューだけに依存せず、複数の品質管理レイヤーを備えています。
  • 音声と非音声の両方のオーディオ収集をサポートし、モデル学習のユースケースを広げます。

Cons

  • ソースには価格が公開されていないため、コストや商取引条件が不明です。
  • サイトには、API、統合機能、対応するサードパーティツールに関する実装詳細があまりありません。
  • 一部の機能は高いレベルで説明されているため、チームはプロジェクト固有のワークフローやデータ形式を個別に確認する必要があります。

FAQ

AIxBlockはLLM向けにどのようなテキストデータを提供していますか?

AIxBlockは、LLMの学習向けに会話アノテーション、意図・エンティティラベリング、RLHFの選好データ、SFTデータセット、安全性評価データなどのテキストデータを提供します。

AIxBlockは多言語のテキストアノテーションをサポートしていますか?

はい。テキストデータのページでは、AIxBlockが多言語プロジェクト、コードスイッチング、地域差のあるバリアント、主要言語に対応したネイティブスピーカーや言語学者をサポートしていると記載されています。

規制対象の組織でもAIxBlockのデータワークフローを利用できますか?

AIxBlockのセルフホスト型プラットフォームは、データをクライアントのインフラ内に保持できるため、データ主権、監査可能性、コンプライアンス対応を必要とする規制対象のチーム向けに位置付けられています。

AIxBlockは音声録音だけを扱いますか?

AIxBlockの音声ページでは、音声収集、文字起こし、音素アノテーション、感情・センチメントラベリングに加え、非音声の音データを必要とするモデル向けの環境音や機械音の収集について説明しています。

AIxBlockはどのようなプロジェクトで使われますか?

ホームページには、多言語の銀行チャットデータ、銀行のコンタクトセンター音声データ、複数ロケールの音声プログラムの事例が掲載されており、このプラットフォームは企業規模のデータ収集・アノテーションプログラム向けであることが示されています。

Quick Facts

カテゴリ
企業向け学習データプラットフォーム
主要データタイプ
テキスト、音声、スピーチ、サウンド
デプロイ
オンプレミス、プライベートクラウド、ハイブリッド、またはエアギャップ
対応言語
製品ページで100以上の言語
主な利用者
規制対象組織を含む企業のAIチーム
ソースドメイン
aixblock.io