Fireworks AI logo

Fireworks AI

認証する

Fireworks AIは、オープンソースモデルの提供、学習、ファインチューニング、デプロイに対応する生成AIプラットフォームです。サーバーレス、オンデマンド、予約型推論と公開価格に対応。

Fireworks AI preview

概要

Fireworks AIは、生成AIモデルの提供、ファインチューニング、学習、デプロイのためのプラットフォームです。公開ページでは、オープンソースのLLMと画像モデルに加え、事前学習後の独自モデルを同じ推論スタックに持ち込める機能が中心に紹介されています。

この製品は、特化型インテリジェンスを軸に位置づけられています。ユーザーはまずサーバーレス推論から始め、専用のオンデマンドまたは予約型デプロイへ移行し、学習ワークフローを使って本番環境に数秒でデプロイできるモデルを作成できます。サイトには、テキスト、ビジョン、画像、音声のモデルを含むモデルライブラリに加え、埋め込みと学習の料金も表示されています。

料金はセルフサービス利用向けに公開されており、トークン単位のサーバーレス推論、100万トークン単位のファインチューニング、GPU秒単位のオンデマンドデプロイが含まれます。価格ページでは、より高速な動作、低コスト、またはより高いレート制限が必要なデプロイ要件について、エンタープライズ顧客にチームへの問い合わせも案内しています。

主な機能

複数の推論モード

スループットとレイテンシに最適化されたスタック上で、オープンソースモデルや独自に事前学習後のモデルを、サーバーレス、オンデマンド、予約型のオプションで提供できます。

API互換の提供オプション

OpenAIおよびAnthropicと互換性のあるサーバーレスエンドポイントを使用するか、マルチリージョン対応の専用オンデマンドデプロイに移行できます。

柔軟な学習ワークフロー

ガイド付き実行、設定ベースのジョブ、または独自の学習ロジックで学習でき、カスタム損失関数、トレーナー、Fireworks GPU上のRLループにも対応します。

学習から提供までの継続性

チェックポイントをすばやく本番環境へデプロイし、学習と提供のスタックを整合させることで、同じモデルを引き継ぎなしで学習から推論へ移行できます。

モデルライブラリアクセス

オープンなLLM、視覚モデル、音声モデル、画像モデルを含むモデルライブラリを閲覧でき、最近追加された最先端のリリースも含まれます。

統合された料金体系

サーバーレス推論、ファインチューニング、強化学習ファインチューニング、埋め込み、オンデマンドGPUデプロイの料金を一か所で確認できます。

一般的なユースケース

  • サーバーレスモデル提供

    すばやく開始してトークン単位で課金されたい場合に、サーバーレスエンドポイント経由でオープンソースの基盤モデルを提供します。

  • 本番環境へのデプロイ

    チームがマルチリージョン提供、カスタム性能調整、またはより高いクォータを必要とする場合に、事前学習後モデル向けの専用デプロイを実行します。

  • モデルの学習と調整

    ガイド付き、設定主導、またはカスタムコードのワークフローを使用してモデルをファインチューニングまたは学習し、その後チェックポイントを本番環境に移行します。

  • モデルの選定と評価

    現在のモデルライブラリを閲覧してテストし、特定のタスクに対してLLM、ビジョンモデル、音声モデル、画像モデルのいずれを選ぶかを決定します。

  • API移行

    サービスURLを変更するだけで、アプリを再設計せずに既存のAPIベースのアプリケーションを移行するために、互換性のあるサーバーレスエンドポイントを使用します。

Pros and Cons

Pros

  • 推論、ファインチューニング、学習、デプロイを1つのプラットフォームで提供します。
  • テキスト、ビジョン、音声、画像カテゴリにわたるオープンソースモデルをサポートします。
  • サーバーレス、オンデマンド、予約型の提供オプションを用意しています。
  • セルフサービス利用向けの料金と、エンタープライズ向けの個別問い合わせ窓口を公開しています。
  • OpenAIおよびAnthropicスタイルのサーバーレスアクセスとの互換性を文書化しています。

Cons

  • 公開ページには、完全なSDK、統合、または互換性マトリクスは掲載されていません。
  • 確認したページでは、各モデルやデプロイ種別ごとの詳細なセットアップ手順、制限、ワークフロー上の制約は明記されていません。
  • 一部の提供内容はマーケティングページ上で高レベルに説明されているため、実装の詳細にはドキュメントが必要になる場合があります。

FAQ

Fireworks AIは何を提供していますか?

Fireworks AIは、オープンソースモデルやプラットフォーム上で学習したモデルを提供するためのサーバーレス推論、オンデマンドデプロイ、予約容量を提供します。価格ページでは、教師あり、嗜好、強化学習の各手法に対応したファインチューニングオプションも示されています。

Fireworks AIの料金体系はどのようになっていますか?

価格ページによると、サーバーレス推論はトークン単位の料金とゼロセットアップで利用でき、開始時に1ドル分の無料クレジットが含まれています。オンデマンドデプロイはGPU秒単位で課金され、エンタープライズ利用者はチームへの問い合わせを案内されています。

Fireworks AIは既存のAI APIや統合をサポートしていますか?

このサイトでは、OpenAIおよびAnthropicと互換性のあるサーバーレスアクセス、専用のオンデマンドデプロイ、ならびにオンデマンドワークロード向けのマルチリージョン対応が強調されています。公開ページには、完全なSDKや統合マトリクスは掲載されていません。

Fireworks AIでモデルのファインチューニングや学習はできますか?

はい。サイトでは、ガイド付き実行から設定主導のジョブ、カスタム学習ロジックまで幅広い学習ワークフローが説明されており、チェックポイントを数秒で本番環境にデプロイできるとされています。

Fireworks AIはセルフサービス型ですか、それとも営業主導型ですか?

公開ページでは、推論、学習、デプロイ、モデル閲覧が強調されていますが、確認したページには詳細なセットアップ手順や完全な統合カタログは掲載されていません。

Quick Facts

カテゴリ
生成AIプラットフォーム
主な焦点
推論、学習、ファインチューニング、デプロイ
モデルの種類
オープンソースLLM、ビジョンモデル、画像モデル、音声モデル
提供モード
サーバーレス、オンデマンド、予約容量
料金体系
トークン単位、100万学習トークン単位、GPU秒単位
Webサイト
fireworks.ai