XAI推出了他们的Grok FAST模型,这是一款专注于编码的新模型,曾在Grok发布时被预告过。

目前基准测试数据较少,因为XAI团队通常在一周后才会分享这些信息。据我们所知,这与Sonic是同一模型。正如我在Sonic视频中提到的,这是Grok代码模型,它不仅经济实惠,价格也极具竞争力,分别为20美分和1.50美元,成为史上最便宜的代码模型之一。

其价格已非常接近Deepseek。虽然我不会说它比新版本的Deepseek更好,但它仍是一款优秀的自主模型,且运行速度极快,每秒可处理约80个Token,这在同类模型中表现相当出色。

它的基准测试得分与Sonic相同,在这些项目上均未取得进展。

该模型无法处理平面图等复杂任务,但在分块编辑或类似工作流中表现优异。作为第一代编程模型,其设计有许多可取之处。其主要竞争对手可能是GPT-5 Mini。

GPT-5 Mini的价格略高,但其编程能力显著提升。虽然生成速度为每秒40个Token稍显缓慢,但该模型存在一个明显缺陷:即使在执行简单任务时也容易偏离主题。

例如,我仅要求其解释项目的功能,但它却直接进行了编辑操作。这种情况并非个例。

它经常发生,你可以在KiloCode上亲自尝试。KiloCode与XAI合作,使用户能够免费使用这款模型。

周末期间,使用不受任何限制。只需注册一个Kidocode账户即可开始使用。

即使您不领取这25美元的免费额度,服务仍可正常使用。该额度为领取后的额外赠送。

最后,你还可以用这些额度去对比其他模型。

在RootCode上也有类似的期限,你可以免费使用。在OpenCode上也是同样的时长。

该模型的另一特点是,其推理能力有限,每次最多仅能生成一两行内容,实用性较低。因此,我无法理解为何它会被归类为推理模型。

不过,该模型在某些任务上仍具有实用价值,特别是在需要高速处理的任务中。

总的来说,我推荐使用GPT-5 MiniDeepseek V3.1来处理大多数任务。这两款模型不仅性能优越,而且价格更具竞争力。特别是GPT-5 Mini还支持用户自定义推理强度,并能调节输出内容的详细程度,这些功能都优于GrokCode。

虽然目前GrokCode的具体表现尚不明确,但我仍会继续采用GrokCode、Deepseek和GPT-5 Mini的组合方案,这个搭配在性价比方面表现突出。

如果你需要同时使用Grok和Grok代码,可以通过XAI官方API进行调用。

因为它们提供了兼容 Entropic 的API,可以直接修改 Cloud Code 的基础 UIL 来使用。

在此之前,先介绍 NinjaChat——一个集成多种AI模型的平台。每月仅需11美元即可使用 GPT-4.0 等顶尖AI模型,还包括 Cloud ForceSonic 和 Gemini 2.5 Force 等模型。

我常用 Gemini 进行快速资料收集,但最突出的是其 AI Playground 功能,可以并排对比不同模型的输出结果。其 思维导图生成器 尤其擅长整理复杂想法。

基础套餐每月包含1000条消息、30张图片和5个视频。如需更多资源,可选择更高级的套餐

使用折扣码 KIE25 可享受任意套餐8折优惠,输入 KMJ40YEAR01 可享年付订阅6折优惠。详情请查看简介中的链接。

接下来继续。我选择使用 Requesting工具,因其比OpenRouter更符合我的使用需求。

它将提供 Enthropic 的接口,可用于配置类似 Claude 的代码。此外还包含 Grok 的代码模型,这样积分就不会仅限用于 XAI 平台。若不满意,还可搭配其他模型使用。用户也可选择通过 OpenRouter API 集成 ClaudeCodeRouter 实现功能调用。

Tuber Code的另一个问题是,尽管其上下文窗口高达256K token,但存在显著的遗忘现象。

例如,我要求它遵循特定的编码模式,不编写注释。它会执行一段时间,随后便遗忘这一要求。

我尝试使用ByteOver来解决这个问题。它类似于一个内存层。

你可以通过 MCPSERVERS插件 接入AI编码器。该插件支持编码器创建并同步ByteRover。编码器中的记忆将同步至所有接入ByteRover的编码器中,并支持与团队成员共享这些记忆。

因此,我尽可能频繁地使用它。这样当遗忘时,就能通过它来回忆信息。

你可以将指令或编程范式存储其中,并让它读取这些信息以遵循规范。我认为这是一个优秀的编码模型,但它仅专注于编程领域。

这会限制其在诸多领域的应用范围。

因为它无法设计美观的用户界面,也无法构建合理的系统架构,容易偏离预期目标。

这就容易出问题。GPT5 MiniDeepSeek在这方面表现优异,它们都是通用模型,尤其擅长编程。就连Sanity也是通用模型,巧合的是同样擅长编程。我认为这正是国内模型的短板所在。

总的来说,XAI团队的这一进展很有意义,至少成功开发出了擅长工具调用的模型,在编码方面也相当出色。更令人印象深刻的是,这是他们第一代模型就实现的成就。希望它能持续改进,在下一代中变得更强大。期待未来能看到思维更强大的版本。ps,找云服务器,8⃣️月份有羊毛可以薅yijiacloud.com.cn,注册就有50算力金。

你可以将其与DeepSeek这类模型结合使用,让DeepSeek担任架构师角色,负责代码检查和技术指导。如果想了解具体使用方法,我可以制作相关教程视频。

Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐