xAI推出了Grok 4.3——一款面向代理任务、更加实用的人工智能模型。
xAI 推出 Grok 4.3——一款在令牌使用上更节省、速度更快的模型
马斯克旗下 xAI 公司推出了其 AI 模型的新版本——Grok 4.3。与前代(Grok 4.20)相比,它将输入令牌成本降低 40%,输出令牌成本降低 60%。这使其对开发者和企业更具可及性,并提升了工作效率。
| 指标 | Grok 4.3 | Grok 4.20 |
|---|---|---|
| 输入令牌成本(百万美元) | $1.25 | $2.08 |
| 输出令牌成本(百万美元) | $2.50 | $6.25 |
| 速度 | 100 令牌/秒 | – |
| 上下文窗口 | 1,000,000 令牌 | – |
关键功能
* 自主搜索——模型可自行在互联网上及 X(前 Twitter)中查找信息。
* 代码执行——支持 Python 脚本。
* RAG(检索增强生成)——对本地文件进行检索。
* 文档生成——Excel、PDF、PowerPoint。
xAI 开发负责人 Eric Jiang 表示,Grok 4.3 的设计重点是速度、低成本和工具功能的扩展。该模型每秒可处理 100 个令牌,并支持多达一百万词的上下文。
测试费用
在所有 Artificial Analysis 测试中完整运行 Grok 4.3 的费用仅为 $395,远低于 GPT‑5.5($3,959)和 Claude Opus 4.7($4,811)。专家认为 Grok 4.3 已达“帕累托前沿”——价格与性能的最佳平衡。
Intelligence Index 评分
* 53 分(高于前代,但低于 OpenAI 和 Anthropic)。
* 与 Muse Spark 和 Claude Sonnet 4.6 相比略高。
* 比 Grok 4.20 高四分,仍明显落后于市场领头羊。
GDPval‑AA 测试结果
* Elo 评级提升 321 分至 1,500。
* 超越 Google 的 Gemini 3.1。
* GPT‑5.5 仍以 276 分的差距保持领先。
其他独立测试
| 测试 | 结果 |
|---|---|
| Andon Labs(自动化管理) | 模型有时会“进入睡眠”,无法完成任务。 |
| Vals AI – CaseLaw, CorpFin | Grok 4.3 获得第一名。 |
| 综合代码与复杂数学题测试 | 第 13 名。 |
新功能
xAI 同时推出了 Grok Imagine 的 Agent Mode 测试版,可通过网页界面使用。该模式旨在支持长期创意项目,如规划、生成、编辑和完善材料,而非单次查询。据 xAI 称,该工具适用于制作短片或产品故事。Agent Mode 可在网页左下角激活,并需要付费订阅。
获取 Grok 4.3 的渠道
* OpenRouter
* xAI API
* Hermes 代理
综上所述,Grok 4.3 是一款经济高效、速度快且功能丰富的模型,适合开发者和企业使用,但在某些专业任务中仍略逊于竞争对手。
评论 (0)
分享你的想法——请保持礼貌并围绕主题。
登录后发表评论