GPT-4 Turbo 击败 Claude 3，重新夺回 “最佳AI模型” 称号

新闻公告

GPT-4 Turbo 击败 Claude 3，重新夺回 “最佳AI模型” 称号

发布时间：2024-04-16 12:56:26

划重点:
⭐️ OpenAI 的最新更新使 GPT-4Turbo 在 Chatbot Arena 中超越了82个 LLM 模型
⭐️ 用户可以在 Chatbot Arena 中比较不同模型的答案，GPT-4Turbo 表现出色
⭐️ 想要比较 GPT-4Turbo 与其他 LLMs 可以访问的性能 Chatbot Arena 比较网站

站长之家（ChinaZ.com）4月16日消息:OpenAI 最新更新版本的推出 GPT-4Turbo 上周，开发人员和付费人员已经面向开发人员 ChatGPT 提供订阅者。当这个模型推出时，OpenAI 表示新的 GPT-4Turbo 以前的工作做了很多改进，用户也发现这是真的。

从上周四开始，更新版本开始了 GPT-4Turbo，即 gpt-4-turbo-2024-04-09，重新夺回 Large Model Systems Organization（LMSYS）Chatbot Arena 排名第一，这是一个众包开放平台，用户可以对其中的大型语言模型进行评估(LLM)。

在 Chatbot Arena 用户可以和两个一起使用 LLMs 并排聊天，比较他们的答案，而不知道每个模型的身份。这些结果被用于排名 Chatbot Arena 中的82个 LLMs，包括市场上的一切最受欢迎的 LLMs，如 Gemini Pro、Claude3系列 LLMs 和 Mistral-Large-2402。

截至4月13日的最新 Chatbot Arena 更新，更新版本 GPT-4Turbo 在整体、编码和英语类别中处于领先地位。这意味着不到一个月后，Anthropic 的 Claude3Opus 在整体类别中排名第二，其次是 GPT-4Turbo 的旧版本 GPT-4-1106-preview。

可能是因为这些结果 gpt-4-turbo-在编码、数学、逻辑推理和写作能力方面，2024-04-09的表现高于一系列用于测试的测试 AI 基准测试模型熟练程度。想自己比较一下 gpt-4-turbo-2024-04-09与其他 LLMs 的表现?可以访问 Chatbot Arena 网站，点击 “Arena（side-by-side）” 选项，选择要比较的模型。

值得注意的是，您将无法投票，因为您知道侧模式中模型的身份。如果你想投票并将其列入排行榜，你可以使用它 “Arena（battle）” 选项将随机模型进行比较。如果您想跳过测试，请直接使用 gpt-4-turbo-2024-04-09在 ChatGPT 中，需要成为 ChatGPT Plus 每月20美元的订阅者费用。

关于我们

新闻公告

GPT-4 Turbo 击败 Claude 3，重新夺回 “最佳AI模型” 称号

八彩云产品

解决方案

帮助与支持

其他链接

联系我们