原型、脚本、Coding Agent 调试不一定一上来就花钱。很多厂商有长期免费档或慷慨试用;额度、模型和是否要绑卡会变,以官网为准。
免费 / 免费额度 API 对比
| 服务 | 类型 | 典型模型向 | 免费形态(约) | 要绑卡 | OpenAI 兼容 | 亮点 | 注意 |
|---|---|---|---|---|---|---|---|
| Google AI Studio / Gemini | 厂商 API | Gemini Flash 等 | 按模型 RPM / 日请求上限 | 通常否 | 部分 / 官方 SDK | 长上下文、多模态,好上手 | 免费档模型与配额常收紧;部分地区数据条款要看清 |
| Groq | 推理加速 | Llama / Gemma 等开源权重 | RPM + 日请求上限 | 通常否 | 是 | 极快,适合实时对话 | 模型目录有限,不是闭源前沿全家桶 |
| Cerebras | 推理加速 | Llama 等 | 日 token 额度较大 | 通常否 | 是 | 吞吐高、长输出友好 | 模型选择相对窄 |
| OpenRouter | 聚合网关 | 多厂商;看 :free | 一批 $0 模型;日请求有限 | 免费模型通常否 | 是 | 一把钥匙试很多模型 | 免费档 RPM/日限紧;模型列表会轮换 |
| NVIDIA NIM(build.nvidia.com) | 托管推理 | 大量开源 / 领域模型 | 按分钟请求上限一类 | 通常否 | 视接口 | 模型多、批处理向 | 注意限流形态 |
| Cloudflare Workers AI | 边缘推理 | 多种小模型 | 日 neurons 配额 | 通常否 | 部分 | 边缘、和 Workers 一体 | 上下文与模型能力偏轻;配额难估算 |
| GitHub Models | 开发者试用 | 多家(含闭源试用向) | 日请求限额 | 绑 GitHub | 视文档 | 方便在 GitHub 生态里试模型 | 和 Copilot / 账号档位相关 |
| Hugging Face Inference | Serverless | 海量开源模型 | 免费档有冷启动 | 通常否 | 视路由 | 任意开源模型试一把 | 冷启动、小模型为主 |
| Together AI | 托管开源 | Llama / Qwen 等;部分 Free | 标注 Free 的模型 | 视套餐 | 是 | 开源模型托管成熟 | 免费目录会变 |
| Mistral | 厂商 API | Small / Codestral 等 | 实验档月 token 较慷慨 | 视套餐 | 是 | 欧洲厂商、编码向 | 常要求实验 / 训练相关条款 |
| SambaNova 等 | 推理加速 | 开源权重 | RPM + 小额 credit | 视注册 | 是 | 开源模型加速 | 日请求可能很少 |
| DeepSeek | 厂商 API | V3 / R1 等 | 新用户 token 试用 / 极低价 | 常要 | 是 | 推理强、单价低 | 更偏「便宜」而非永久免费 |
| 智谱 / 通义 / 硅基流动等 | 国内云 | GLM / Qwen 等 | 新用户赠额或免费档 | 视平台 | 多兼容 | 国内网络与备案友好 | 赠额用完即付费;核对实名与发票 |
| Ollama / LM Studio | 本地 | 本机拉取的开源模型 | 无限(吃自己的机器) | 否 | 是(本地) | 隐私、离线、无云限流 | 受本机显存 / 内存限制 |
「永久免费」和「新用户赠额」要分开看:前者适合长期玩具项目;后者只适合评估。
Coding Plan 对比
详细测试数据可参考 awesome-coding-plan。
| 厂商 / 套餐 | 价格(约) | 额度 / 模型 | 适合 | 注意 |
|---|---|---|---|---|
| Claude Pro / Claude Code | $20/月 | Claude Code,按 5 小时与周窗口限额 | 复杂代码库、重构 | 用量峰值时可能受限;关注数据训练条款 |
| ChatGPT Plus / Codex | $20/月 | Codex,滚动窗口消息额度 | OpenAI / GitHub 用户 | 额度随模型和负载变化 |
| OpenCode Go | $10/月(首月约 $5) | GLM、Kimi、MiMo、DeepSeek、Qwen、MiniMax 等模型 | 终端多模型、低成本尝试 | 模型池和额度规则会调整 |
| Kimi Code Andante / Allegretto | ¥49 / ¥199/月 | Allegretto 约为 Andante 的 20 倍额度 | 长上下文、中文代码 | 低档性价比和高峰期稳定性需要实测 |
| GLM Coding Plan Lite / Pro | ¥49 / ¥149/月 | Lite 约 3×、Pro 约 5× Claude Pro 用量 | 国内访问、GLM 代码能力 | 5 小时 / 周限额;高峰期可能 429 |
| 火山方舟 Coding Plan Lite | ¥40/月 | 多倍于 Claude Pro 的用量,主打 Doubao | 想试多模型、偏字节生态 | 库存和限额可能每日变化 |
| Ollama Pro | $20/月 | Ollama Cloud 开源模型额度;Ollama Free 可本地无限运行 | 开源模型、隐私与本地优先 | 云端额度和本地算力是两套限制 |
| NVIDIA NIM | 免费 | 多个开源模型,最高约 40 RPM | 个人免费试用 | 无稳定性保证,免费政策可能收紧 |
| Command Code Go / GOAT / Pro / Max 10× / Max 20× | $1 / $10 / $20 / $100 / $200/月 + 手续费 | $10 / $70 / $80 / $150 / $300 credits;典型约 1.5 万 / 7.5 万 / 10 万 / 21.9 万 / 43.7 万次请求 | 终端 Coding Agent;taste-1 会学习编码偏好 | Go / GOAT 以开源模型为主,Pro 及以上支持开源模型与高级模型;额度随模型、上下文和提示词长度变化 |
AI IDE / Plugin Plan
详细对比可参考 awesome-coding-plan。
| 工具 / 套餐 | 价格(约) | 额度 / 计费方式 | 适合 | 注意 |
|---|---|---|---|---|
| Factory Droid Pro | $20/月 | 2000 万 Standard Tokens;按用量计费 | Agent 驱动的工程任务 | 缓存 token 与普通 token 折算规则要看清 |
| Cursor Pro | $20/月 | 每月约 $20 API 使用额度;Auto / Composer 可能有额外用量 | AI 原生 IDE、多文件编辑 | 用量耗尽后按模型价格或套餐规则处理 |
| Windsurf Pro | $20/月 | 日 / 周预算;Premium Model 约 8–101 条消息 / 日;SWE-1.5 有独立额度 | IDE 内连续开发 | 配额按日、周双重限制 |
| Kiro Pro | $20/月 | 1000 credits;超额约 $0.04 / credit | 需求规格驱动开发 | 新用户赠额和试用条件会变化 |
| Augment Code Indie | $20/月 | 约 40000 credits | 大型代码库理解与重构 | 按 credits 消耗 |
| Qoder Pro | $20/月 | 2000 credits;通常有试用与赠送 credits | IDE Agent、长任务 | 试用期限与 credits 规则需确认 |
| Google AI Pro / Gemini Code Assist / Gemini CLI | $19.99/月 | Google AI 订阅额度;Gemini CLI / Code Assist 按日请求限额 | Google / Gemini 技术栈 | 产品资格和服务政策变化较快 |
| Kilo Pass Starter | $19/月 | 最多约 40% bonus credits | 多模型 IDE / Agent | bonus 不等于固定 API 额度 |
| Trae Pro | $10/月 | Basic usage + Bonus usage;无限自动补全 | 低成本 IDE 体验 | Bonus 额度和模型范围可能随机调整 |
| GitHub Copilot Pro | $10/月 | 每月约 $15 premium credits | GitHub、VS Code 生态 | Premium requests 按模型消耗 credits |
怎么接(OpenAI 兼容)
多数推理站支持改 base_url + api_key + model:
# 示例:指向兼容 OpenAI 的网关(以各家文档为准)
export OPENAI_BASE_URL="https://api.example.com/v1"
export OPENAI_API_KEY="sk-..."
OpenRouter 免费模型名常带 :free 后缀。本地则:
ollama serve
# base_url 类似 http://127.0.0.1:11434/v1
推荐
- 一钥多模型试错 → OpenRouter(挑
:free)。 - 要速度 → Groq;要日 token 量大 → Cerebras。
- 长上下文 / 多模态 → Gemini(AI Studio)。
- 隐私、离线、无限玩 → Ollama(或 LM Studio)。
- 国内访问与开源托管 → 硅基流动 等(看当前赠额)+ 自备 Ollama。
- 真要稳定生产 → 别用免费档;换成付费档。
注意
- 免费档几乎都有 RPM / TPM / 日请求 天花板,Agent 多轮 + 工具调用很容易打满。
- 看清 数据是否用于训练、地区条款、商用是否允许。
- 模型名单和配额变动快,写进 CI 前先做降级与多供应商切换。
- 「完全免费、无限制」的第三方镜像站风险高(Key 泄露、内容审计、突然关停),优先官方渠道。