谷歌确定了用于创建Android应用的顶级AI模型——Gemini落后于GPT
43
software
Google 更新了 Android Bench 排名
Google 再次重新评估其针对 Android 开发的最佳人工智能模型列表。在新名单中出现了许多公开权重,以及对使用令牌和每个模型工作成本的详细统计。
测试的新内容
- 平均延迟 – 解决 100 个任务所花费的时间,基于十次运行。
- 总令牌数 – 单次运行平均消耗的令牌(十次运行之和)。
- 成本 – 每一次基准测试启动所产生的美元费用。
这些指标使结果更加透明,并允许不仅比较速度,还能评估模型的经济效益。
最佳模型
| 排名 | 模型 | 关键数据 |
|---|---|---|
| 1 | OpenAI GPT 5.5 (2024‑05‑18) | 大约比 Gemini 3.1 Pro 快 2%,但运营成本更高 |
| 2 | Google Gemini 3.1 Pro | 领导者中最具经济性;几乎是 GPT 5.5 的一半价格 |
| 3 | OpenAI GPT 5.4 | 与 Gemini 3.1 Pro 同级,但速度不及 GPT 5.5 |
| 4 | GLM 5.1(公开模型) | 在公开权重中表现最佳 |
接下来会发生什么
Google 最近推出了新的 Gemini 3.5 Flash 版本,随后将发布更强大的 Gemini 3.5 Pro。值得关注它们如何与当前领头羊 GPT 5.5 竞争,以及成本和速度指标将如何变化。
因此,Android Bench 的排名现在不仅显示哪种模型更快,还能评估在 Android 应用开发中使用 AI 的经济组成部分。
评论 (0)
分享你的想法——请保持礼貌并围绕主题。
登录后发表评论