事情是这样的。
装上 Kilo Code,搜 free,弹出来 9 个模型。

Auto Free、Step 3.7 Flash、Laguna M.1、Nemotron 3 Ultra……
懵了。
选哪个?哪个能用?哪个有坑?
翻了圈中文社区,没人系统讲过。那我来。
一句话结论
日常主力用 StepFun Step 3.7 Flash,复杂任务换 Laguna M.1,敏感代码一个都别用。
原因后面展开。
先看这 9 个模型长什么样:

Kilo Code 把免费模型分了两层:
-
推荐区(上面那 3 个):官方筛过,相对靠谱 -
Kilo Gateway 区(下面那 6 个):合作厂商直供,良莠不齐
先讲推荐区,再说 Gateway 区。最后说哪些打死不能碰。
第一步:认准 Step 3.7 Flash,大多数时候用它就够了
这是截图里当前选中的那个,也是信息最全的一个。
|
|
|
|---|---|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
翻译成人话:196B 的大模型,但每次只跑 11B,又强又快。256K 上下文,能一口气读完一个中型项目的全部代码。能看图,能看视频。
在 AI 编程工具里,免费模型带多模态的,一只手数得过来。
怎么用最划算:
简单补全 → 推理开 Low,秒出结果 复杂重构 → 推理开 High,让它多想一会 有设计稿 → 直接贴图,让它写前端代码

第二步:Laguna M.1 留着干重活
Poolside 出的。Poolside 这家公司只做一件事:AI 写代码。
在免费区里,Laguna 有两个:M.1 和 XS.2。M.1 是大的,XS.2 是小号的。
规律很简单:代码逻辑复杂的用 M.1,只想快速补两行用 XS.2。
但 XS.2 在 Gateway 区,说明官方对它的信心不如 M.1。
第三步:Auto Free 最方便也最危险
Auto Free 排在推荐区第一个,Kilo 的自动路由——你不用选,它帮你挑当前最优的免费模型。
方便是真方便。但截图里有一个细节,很多人扫一眼就过了:
⚠️ 数据可能会用于训练
这行字在 Step 3.7 Flash 的详情面板底部,但它不仅适用于 Step 3.7 Flash。
Auto Free 的请求可能被路由到任何厂商的服务器。你的代码去到了哪里、谁在看、被用来干什么——你不知道。
哪些情况可以用 Auto Free:
-
写 Demo、学习项目、开源代码 -
不含任何公司信息的个人练习
哪些情况绝对不要碰:
-
公司业务代码 -
包含客户数据的项目 -
加密逻辑、认证模块、支付相关 -
配置文件中出现过 password / token / key 的地方
一句话记牢:敏感代码用免费模型 = 代码裸奔。

第四步:Gateway 区的 6 个,按需取用
然后才是 Gateway 区。
Cohere North Mini Code
名字里 Mini 和 Code 都在,轻量、代码专精。Cohere 企业级 NLP 的底子,不会太差。日常辅助够用。
Free Models Router
不是具体模型,更像一个负载均衡入口。和 Auto Free 的区别:Auto Free 是智能选优,Router 是随机分发或轮询。稳定性有余,质量没保证。
NVIDIA 三兄弟:Nano Omni / Super / Ultra
截图里 NVIDIA 一口气占了三席。像吉祥三宝。
|
|
|
|---|---|
|
|
|
|
|
|
|
|
|
有意思的是:NVIDIA 这三个全免费。明摆着推广自家生态,先让你免费用,习惯了你自然会看他们的付费模型。
⚠️ NVIDIA 免费端点的数据使用条款和 Step 3.7 Flash 一样——数据可能被用于训练。 甚至更严格。根据 NVIDIA API 试用条款,仅限试用、不可用于生产环境或处理敏感数据。
除非你对 NVIDIA 生态有特殊需求,否则这三个不是最优选。
Poolside Laguna XS.2
Laguna 的小号版。速度比 M.1 快,能力比 M.1 弱。写几行简单代码还行,别让它干架构设计的活。
给不同人的配置方案
学生 / 自学者
主力:Step 3.7 Flash。图多就开多模态,代码多就开推理 High。完全够用。
个人开发者
Step 3.7 Flash(日常)+ Laguna M.1(复杂任务)。两个轮换,速率限制来了就切。
有保密要求的在职开发者
⚠️ 别省这点钱。 公司代码丢不起。老老实实用付费模型,免费模型只用来查文档、学新框架。
技术博主 / 开源贡献者
随意用。公开代码本来就不怕看,免费的不用白不用。顺手还能反馈一下模型效果,推动生态变好。
三个打死不能犯的错
错误一:敏感项目用 Auto Free
你的代码去了哪里、经过哪家厂商的服务器、会不会被存下来——三个问号。Auto Free 就是开盲盒,但你没拿到礼物,是送出去了礼物。
错误二:生产环境依赖免费模型
免费模型是上游厂商免费提供的。今天有,明天可能就没了。速率限制随时会变。你线上的工作流不能建立在"别人免费给你用"的基础上。
错误三:把 API Key 或密码贴进对话
截图里白纸黑字写着"数据可能会用于训练"。你贴进对话的 key、token、密码,理论上都可能被存下来。这不是猜的,是条款里的。
总结
Kilo Code 的免费模型确实能打。尤其是 Step 3.7 Flash——多模态、256K 上下文、MoE 高效架构,这三个标签放在一起,在免费圈几乎没有对手。
但"免费"的前提是数据可能被用于训练。这一点,截图里写了,我也再说一遍。
用之前,先想清楚:你写的这行代码,能接受被别人看到、被存下来、被拿去训练模型吗?
能,就放心用。不能,就老老实实花钱。
就这么简单。
