GLM-5+Kimi K2.5免费调用,三分钟搞定模型配置
昨天上午刷GitHub,看到有人说英伟达NIM上了两个国产模型。我点进去一看:GLM-5 和Kimi K2.5。
关键是免费调用。

说实话,我第一反应是"真的假的"。但手比脑子快,已经点开build.nvidia.com开始注册了。
用了三天,现在来交个作业。
先说说NIM是个什么东西
NIM全称NVIDIA Inference Microservices,英伟达的模型推理平台。
通俗点讲,就是个模型超市。以前上面只有Llama、Mistral、Gemma这些国外开源模型,现在货架上多了俩国产货:智谱的GLM-5和月之暗面的Kimi K2.5。

这两个都是年前发布的新模型。
GLM-5是智谱的新旗舰,Kimi K2.5也是同期产品。WebDev Leaderboard排行榜上,GLM-5 和 Kimi K2.5 均有不错的排名。
属于国产模型的第一梯队。

现在英伟达把它们塞进NIM,没官宣,但API确实能用了。我上去看了眼,资源还挺抢手,有时候有点卡,不过个人用的话完全够。
怎么搞?其实不复杂
整个流程就三块:注册账号、拿API Key、配客户端。
注册账号
打开build.nvidia.com,右上角点Login。输邮箱、设密码、Create Account。邮箱会收到6位验证码,填进去。起个账户名,搞定。

有个坑要注意:页面右上角有个Verify,必须点。然后输手机号验证。国内+86号码能用,亲测。
生成API Key
登录后,点右上角头像 → API Keys。

点击 Generate API Key。

给Key起个名字,过期时间调成"Never",也就是100年。

点Generate Key,你会拿到一串nvapi-xxx开头的字符串。

这玩意儿要保存好。 它能调用NIM上所有免费模型,包括今天说的这两个国产模型。
下载 Cherry Studio
官网:https://www.cherry-ai.com/

配置模型
打开Cherry Studio,左下角点设置,模型服务选择"NVIDIA"。
配置参数:
- API密钥:粘贴刚才复制的nvapi-xxx
- API地址:https://integrate.api.nvidia.com
- 模型ID:我推荐这三个 - z-ai/glm5 - moonshotai/kimi-k2.5 - minimaxai/minimax-m2.1 minimax实际最新模型是m2.5,但是NVIDIA暂时没有,预计后续会更新出来,这里先使用m2.1。

保存,完事。现在就能开始对话了。
使用技巧
Cherry Studio 比较便捷的是一次可以同时与多个模型进行对话,底部勾选模型即可。

点击使用模型回答样式:横向排列,实现多个模型回答的效果对比。。

但也有坑:
- 资源紧张时会排队
- 高峰期速度明显下降
我的看法是:轻度使用没问题,想当主力工具还差口气。
如果你是开发者,想接API做产品,建议还是买官方的商业版。MiniMax、智谱、Kimi都有Coding Plan,价格不贵,稳定可靠,速度也快。
但如果你只是个人用户,想白嫖个大模型API放在客户端里日常使用,NIM这个方案挺香的。
总结一下
英伟达这波操作挺良心的。把两个国产顶级模型免费开放给开发者,对AI生态是好事。GLM-5和Kimi K2.5都是第一梯队的大模型,现在能免费调用,机会难得。
资源有限,用的人越多体验可能越差。想白嫖的抓紧,手慢无。我建了个AI交流群,专门分享这种白嫖攻略和实用技巧。感兴趣的朋友关注后回复"加群",我拉你进群。
更多推荐



所有评论(0)