Google发布了一个实验性模型Gemini-1114,该模型现在与OpenAI的ChatGPT-4o-latest一起在Chatbot Arena排行榜上并列第一。经过超过6000名社区投票测试,该模型获得了1344的整体Arena分数,超越了之前的Gemini版本并击败了OpenAI的o1-preview。
Gemini-Exp-1114在视觉排行榜和两个未指定的类别中排名第一,在编码和带有风格控制的复杂提示方面排名第三。在直接比较中,它赢得了50%的投票对抗GPT-4o-latest,56%对抗o1-preview,以及62%对抗Claude-3.5-Sonnet。
开发者目前可以通过Google AI Studio测试该模型,API访问预计很快开放。