聊天並比較模型
在同一介面中進行並排聊天與比較模型回覆,並透過投票推動社群排名流程。
Arena 是一個基於真實使用者評估的公開 AI 模型排行榜與比較平台。它讓人們與多個模型對話、比較它們的答案,並透過投票來影響大型語言模型、圖像系統、程式碼模型與代理工具的排名。
該網站將模型表現整理為多個專屬領域,包括文字、視覺、網頁開發、搜尋、影片、圖像編輯與代理任務。因此,它既適合一般比較,也適合想快速了解前沿模型在不同工作類型中表現的讀者。
在同一介面中進行並排聊天與比較模型回覆,並透過投票推動社群排名流程。
使用 Battle Mode 透過直接的一對一互動來評估前沿模型,而不只依賴靜態基準表。
瀏覽涵蓋文字、網頁開發、視覺、文件、圖像、搜尋、影片與影片編輯任務的廣泛排行榜。
查看獨立的代理排行榜,著重工具使用、任務完成度、可靠性與可引導性,適合真實世界的代理工作。
檢視帶有分數顯示與不確定區間的模型排序清單(若有提供),比單純的有序列表更具脈絡。
在 Arena 介面中搜尋聊天記錄,找出先前的對話與過往互動。
測試不同前沿模型如何回答相同提示,再對結果投票,以協助公開排名更貼近真實比較。
當你想快速了解某一特定任務類別中哪些模型領先時,可查看文字、視覺、網頁開發、圖像、搜尋或影片領域的排行榜。
使用代理排行榜來評估模型如何協調工具並完成真實世界的代理任務。
當你需要回顧先前提示或自己聊天記錄中的輸出時,可搜尋 Arena 中較早的對話。
Arena 是一個公開的 AI 模型排行榜與比較網站。使用者可以與模型對話、比較回覆、投票,並查看涵蓋文字、視覺、網頁開發、圖像、影片、搜尋與代理任務等領域的排名。
這個網站以直接的模型比較與公開評估為核心,而不是傳統的軟體套件。首頁強調 Battle Mode,排行榜頁面則依任務類別整理模型,並根據真實世界的評估訊號進行排序。
來源中沒有顯示可用的定價頁面。/pricing 網址目前會回傳 404 頁面,因此無法從提供的證據確認方案、試用或帳單細節。
網站包含聊天記錄搜尋頁面,表示使用者可以搜尋過去的對話。不過,提供的來源並未確認帳號、團隊、API 或工作區功能。