ALL TOPICS
MODEL INTELLIGENCE
AGENTS & GENERATION
COST & INFRASTRUCTURE
METHODS & DATA
Media & Speech
把图像、视频和语音分开比较。不同模态使用不同竞技场和评价口径,不合并成一个跨模态总分。
GPT Image 2 (high)
来自盲测用户投票的 Text to Image Arena。
Gemini Omni Flash
含音频文生视频竞技场;比较视频质量、提示遵循、运动表现与声音。
Qwen-Audio-3.0-TTS-Plus
通过音频盲听投票比较语音自然度与质量。