無伺服器推論
無需管理基礎架構即可按需執行開源模型,首頁將其定位為使用無伺服器功能的最快途徑。
Together AI 是一個 AI 雲端平台,提供推論、微調、GPU 叢集、沙箱與代管儲存。支援無伺服器與專屬部署,並針對多數工作負載公開定價。
Together AI 是一個 AI 雲端平台,用於建立、部署與最佳化模型工作負載。首頁將其描述為一個全端 AI 平台,涵蓋推論、微調與 GPU 叢集,並另外提供沙箱運算、代管儲存與模型塑形等產品。
此平台圍繞多個部署與工作流程層級組織:用於隨選使用的無伺服器推論、單租戶效能的專屬推論、生成媒體工作負載的專屬容器推論、用於 GPU 存取的加速運算、供開發使用的沙箱環境,以及供正式模型調整使用的微調。定價頁顯示多數無伺服器模型與基礎設施產品都有公開費率,但部分較大型專屬硬體選項需要聯絡銷售。
無需管理基礎架構即可按需執行開源模型,首頁將其定位為使用無伺服器功能的最快途徑。
在單租戶基礎架構上部署模型,享有保證效能、自訂模型支援,以及在流量高峰時自動擴縮。
以每小時 GPU 容量或保留式叢集來執行較大的運算工作,在 H100、H200 與 B200 硬體上顯示按需與保留定價選項。
建立 VM 沙箱,透過 API 安全執行程式碼,並可讓沙箱休眠與恢復,以支援開發工作流程。
使用受監督微調與直接偏好最佳化,針對支援的模型家族訓練開源模型以供正式環境使用。
將資料儲存在代管物件儲存與為 AI 工作負載設計的平行檔案系統中,首頁並表示零流出費用。
團隊可先使用無伺服器推論進行快速實驗,之後在需要更穩定效能或更多控制時,轉移到專屬端點。
需要私有基礎架構的組織可在專屬硬體上部署自訂或開源模型,並享有保證效能與自動擴縮。
開發者可使用受支援的開源模型進行微調,以滿足特定領域的行為需求,採用受監督微調或直接偏好最佳化。
處理較大型工作的 AI 團隊可租用按小時計費或保留式 GPU 容量,用於訓練、評估或其他大量運算工作。
應用程式開發者可使用沙箱與代管儲存來建立開發環境、安全執行程式碼,並讓資料靠近運算資源。
Together AI 是一個雲端平台,用於執行與調整 AI 工作負載。網站重點介紹無伺服器推論、專屬推論、專屬容器推論、GPU 叢集、沙箱環境、代管儲存與微調。
定價頁顯示無伺服器推論、專屬推論、GPU 叢集、沙箱運算、代管儲存與微調。首頁也強調批次推論、專屬模型推論與專屬容器推論。
網站在模型頁面上顯示 OpenAI 相容的 API 模式,例如 `https://api.together.xyz/v1/chat/completions`,並提供 cURL、Python 和 TypeScript 的範例呼叫。
多數無伺服器模型、GPU 叢集、沙箱運算、儲存與微調都有公開定價。某些專屬硬體,例如部分較大型 GPU 選項,則列為聯絡銷售定價。
來源未提供完整的 SDK 或框架相容性清單。不過確實顯示了程式碼範例,以及快速上手指南、文件、試用台存取與模型頁面連結。