Skip to content
Go back

免费 AI API 对比

Edit

原型、脚本、Coding Agent 调试不一定一上来就花钱。很多厂商有长期免费档或慷慨试用;额度、模型和是否要绑卡会变,以官网为准。

免费 / 免费额度 API 对比

服务类型典型模型向免费形态(约)要绑卡OpenAI 兼容亮点注意
Google AI Studio / Gemini厂商 APIGemini Flash 等按模型 RPM / 日请求上限通常否部分 / 官方 SDK长上下文、多模态,好上手免费档模型与配额常收紧;部分地区数据条款要看清
Groq推理加速Llama / Gemma 等开源权重RPM + 日请求上限通常否极快,适合实时对话模型目录有限,不是闭源前沿全家桶
Cerebras推理加速Llama 等日 token 额度较大通常否吞吐高、长输出友好模型选择相对窄
OpenRouter聚合网关多厂商;看 :free一批 $0 模型;日请求有限免费模型通常否一把钥匙试很多模型免费档 RPM/日限紧;模型列表会轮换
NVIDIA NIM(build.nvidia.com)托管推理大量开源 / 领域模型按分钟请求上限一类通常否视接口模型多、批处理向注意限流形态
Cloudflare Workers AI边缘推理多种小模型日 neurons 配额通常否部分边缘、和 Workers 一体上下文与模型能力偏轻;配额难估算
GitHub Models开发者试用多家(含闭源试用向)日请求限额绑 GitHub视文档方便在 GitHub 生态里试模型和 Copilot / 账号档位相关
Hugging Face InferenceServerless海量开源模型免费档有冷启动通常否视路由任意开源模型试一把冷启动、小模型为主
Together AI托管开源Llama / Qwen 等;部分 Free标注 Free 的模型视套餐开源模型托管成熟免费目录会变
Mistral厂商 APISmall / Codestral 等实验档月 token 较慷慨视套餐欧洲厂商、编码向常要求实验 / 训练相关条款
SambaNova 等推理加速开源权重RPM + 小额 credit视注册开源模型加速日请求可能很少
DeepSeek厂商 APIV3 / R1 等新用户 token 试用 / 极低价常要推理强、单价低更偏「便宜」而非永久免费
智谱 / 通义 / 硅基流动等国内云GLM / Qwen 等新用户赠额或免费档视平台多兼容国内网络与备案友好赠额用完即付费;核对实名与发票
Ollama / LM Studio本地本机拉取的开源模型无限(吃自己的机器)是(本地)隐私、离线、无云限流受本机显存 / 内存限制

「永久免费」和「新用户赠额」要分开看:前者适合长期玩具项目;后者只适合评估。

怎么接(OpenAI 兼容)

多数推理站支持改 base_url + api_key + model

# 示例:指向兼容 OpenAI 的网关(以各家文档为准)
export OPENAI_BASE_URL="https://api.example.com/v1"
export OPENAI_API_KEY="sk-..."

OpenRouter 免费模型名常带 :free 后缀。本地则:

ollama serve
# base_url 类似 http://127.0.0.1:11434/v1

推荐

注意


Edit
Share this post on:

Next Post
Go 嵌入式数据库对比