01 / why this exists
为什么需要这个项目
找一个免费 LLM API,不应该翻遍十几个更新日志,为了对比速率限制去注册五个不同平台,或者猜测哪个提供商这个月还有免费额度。
这是一份参考型目录:把提供商、模型、限制条件、获取 Key 的入口和接入方式集中到一起。社区维护、信用卡透明、可复制的代码示例和并排比较,是 README 中最值得保留的使用路径。
重要:免费额度、地区、验证要求和服务条款会变化。下方内容来自参考 README 的整理快照,实际使用前请打开每行的官方链接再次确认。
02 / start here
三步上手
- 选一个提供商:先看下方 Provider Directory;新手可以优先尝试 Groq、Google AI Studio 等清晰标注免费层的入口。
- 获取 API Key:打开 Quick Reference 中对应的官方控制台或密钥页面,确认是否需要邮箱、手机或银行卡。
- 接入代码:把 Base URL 与模型 ID 填入下面的 OpenAI 兼容示例,并根据官方限制控制速率和用量。
03 / quick start
Quick Start — 30 秒接入免费 API
大多数提供商提供 OpenAI 兼容接口。接受 baseURL 与 apiKey 的工具通常只需要替换这两项。
Python(OpenAI SDK)
from openai import OpenAI
client = OpenAI(
base_url="https://api.groq.com/openai/v1",
api_key="GROQ_API_KEY", # 在官方控制台获取
)
response = client.chat.completions.create(
model="llama-3.3-70b-versatile",
messages=[{"role": "user", "content": "Hello!"}],
)
print(response.choices[0].message.content)
编程助手
- Claude Code:配置
ANTHROPIC_BASE_URL与ANTHROPIC_AUTH_TOKEN。 - Cursor:Settings → Models → Add Model。
- Codex CLI:配置
OPENAI_BASE_URL与OPENAI_API_KEY。
04 / provider directory
Provider Directory
⚡ 永久免费额度
持续免费访问,通常会限速,但不以一次性试用为前提。
| 提供商 | 需要信用卡? | 速率限制 | 每日限额 | 月度 / 其他额度 | 主要模型 |
|---|---|---|---|---|---|
| Google AI Studio ↗ | 否 | 5–30 RPM(因模型而异) | 9,000 RPD(Flash) | 完全免费 | Gemini 3.1 Pro / Flash |
| Mistral ↗ | 需手机验证 | 1 request/second | — | Free | Mistral 7B / Mixtral |
| Hugging Face Inference ↗ | 否 | 300 requests/hour | 按月度 credits | $0.10/月路由 credits | Llama / Qwen / Gemma |
| Cohere ↗ | 否 | 20 requests/minute | — | 1,000 requests/month | Command R / R7B / A |
| NVIDIA NIM ↗ | 需手机验证 | 40 requests/minute | — | — | 按模型而定 |
| Groq ↗ | 否 | 30 RPM | 14,400 requests/day | Free forever | Qwen / Llama / Whisper |
| Z.AI (GLM) ↗ | 需注册 | 约 1 request/second | 约 1,000/day | 持续免费层 | GLM Flash |
| Coze ↗ | 需注册 | 因模型而异 | 按 token 计算 | 每日重置 | GPT / Gemini |
| Cloudflare Workers AI ↗ | 否 | 因模型而异 | 10,000 neurons/day | 约 300,000 neurons/month | Llama / Mistral / Qwen |
| LLM7.io ↗ | 否 | 30 RPM / 120 RPM | 最多 5M tokens/day | Free, no billing | DeepSeek / Qwen |
| OVH AI Endpoints ↗ | 需注册 | 2 RPM / 400 RPM | 未公布 | Beta access | Qwen3Guard / SDXL |
| Ollama Cloud ↗ | 否 | Light usage tier | 会话周期重置 | 每周重置 | GPT-OSS / Qwen / DeepSeek |
| Nous Portal ↗ | 否 | 未完整公布 | 未公布 | $0/month | Hermes 4 |
| Hetzner Inference API ↗ | 否 | 按 token 限制 | 500M input / 5M output | 实验阶段免费 | Qwen3.6 |
| Pollinations.ai ↗ | 否 | 匿名约 1 request/15s | 合理使用范围 | Free | GPT / Mistral 类模型 |
| SiliconFlow ↗ | 需手机验证 | 按模型固定限制 | 需登录确认 | 免费模型 | 见官方模型页 |
| ModelScope ↗ | 需手机验证 | 500 requests/day/model | 2,000 requests/day | Free | 见官方模型页 |
| Aion Labs ↗ | 否 | 未公布 | 每日 token allowance | Free | 见官方页面 |
| Inference.net ↗ | 否 | 30 RPM(合理使用) | Fair use | Fair use | DeepSeek / Llama |
💰 可续期额度
定期续期的免费额度,不是一次性用完即止。
| 提供商 | 需要信用卡? | 速率限制 | 免费额度 | 主要模型 |
|---|---|---|---|---|
| OpenRouter ↗ | 否 | 20 requests/minute | 50 requests/day(充值后更高) | Gemini / Llama / NVIDIA |
| Venice.ai ↗ | 需注册 | 10 RPM | Limited daily usage | Llama 405B / Dolphin |
| Requesty ↗ | 否 | 60 RPM | 200 requests/day | Free models |
| Grok (xAI) ↗ | 需注册 | 视额度而定 | $25 one-time signup credit | Grok 2 |
🎁 一次性试用额度
注册后获得一次性 credits 或金额,用完为止;部分平台可能要求注册或充值。
| 提供商 | 注册要求 | 额度 | 有效期 |
|---|---|---|---|
| Together.AI ↗ | 需注册 | 需先充值最低 $5 | — |
| Replicate ↗ | 需注册 | 少量试用额度 | 一次性 |
| Fireworks AI ↗ | 需注册 | $1 | 一次性 |
| SambaNova Cloud ↗ | 需注册 | $5 | 3 个月 |
| Hyperbolic ↗ | 需注册 | $1 | 一次性 |
| Nebius Token Factory ↗ | 需注册 | $1,需银行卡 | 一次性 |
| Cerebras ↗ | 需注册 | $5 | 30 天 |
| Novita AI ↗ | 需注册 | $0.50 | 一次性 |
| Scaleway Generative APIs ↗ | 需注册 | 1M tokens | 一次性 |
| Qwen / Alibaba ↗ | 需注册 | 每模型 1M tokens | 一次性 |
| AI21 Labs ↗ | 需注册 | $10 | 3 个月 |
| Upstage ↗ | 需注册 | $10 | 3 个月 |
| DeepSeek ↗ | 需注册 | 5M tokens | 30 天 |
| Cerebrium ↗ | 需注册 | $30 | 一次性 |
| DeepInfra ↗ | 需注册 | $5 | 一次性,90 天过期 |
05 / local and self-hosted
本地 / 自托管
本地运行可以获得更强的隐私和可控性,但“模型权重免费”不等于 GPU、存储和推理基础设施免费。
| 工具 | 类型 | 亮点 |
|---|---|---|
| Ollama ↗ | CLI + API | 100+ 模型、GPU 加速、OpenAI 兼容 |
| LM Studio ↗ | 桌面 GUI | GGUF 模型、模型浏览器、离线使用 |
| llama.cpp ↗ | C/C++ 引擎 | 运行 GGUF,依赖少 |
| GPT4All ↗ | 桌面应用 | 纯 CPU 运行、开源 |
| Jan.ai ↗ | 桌面应用 | 注重隐私、100% 离线 |
| KoboldCpp ↗ | 单文件应用 | 创意写作、支持 GGUF |
| llamafile ↗ | 跨平台 | llama.cpp + Cosmopolitan Libc |
| Text Generation WebUI ↗ | Gradio 界面 | 高度可定制 |
| BentoML ↗ | 推理平台 | 部署任意 AI/ML 模型 |
06 / quick reference
Quick Reference — Base URL 与 API Key 速查
下面列出 README 中的代表性入口。Base URL、模型 ID 和 Key 获取地址应以提供商官方文档为准。
| 提供商 | Base URL |
|---|---|
| OpenRouter ↗ | https://openrouter.ai/api/v1 |
| Google AI Studio ↗ | https://generativelanguage.googleapis.com/v1beta |
| Mistral ↗ | https://api.mistral.ai/v1 |
| Hugging Face ↗ | https://router.huggingface.co/v1 |
| Fireworks AI ↗ | https://api.fireworks.ai/inference/v1 |
| NVIDIA NIM ↗ | https://integrate.api.nvidia.com/v1 |
| Cerebras ↗ | https://api.cerebras.ai/v1 |
| Groq ↗ | https://api.groq.com/openai/v1 |
| DeepSeek ↗ | https://api.deepseek.com/v1 |
| Z.AI (GLM) ↗ | https://api.z.ai/api/paas/v4 |
| Coze ↗ | https://api.coze.com/v1 |
| SiliconFlow ↗ | https://api.siliconflow.com/v1 |
| ModelScope ↗ | https://api-inference.modelscope.cn/v1 |
| Ollama Cloud ↗ | https://ollama.com/v1 |
07 / guides and community
使用指南与社区功能
- 2026 年最佳免费 LLM API:主流选择横向对比。
- Gemini vs ChatGPT(免费版):了解免费版的实际使用边界。
- 如何使用 OpenRouter:附代码的配置教程。
- OpenRouter 替代方案、Ollama 本地模型和终极免费 LLM API 指南。
- 社区用户可以提交新的提供商、建议编辑、投票或举报已变化的免费状态。
来源边界:本页面借鉴并展示参考 README 的信息结构与部分目录内容;本站自己的 Offer 仍以官方证据和 `data/offers.json` 为准。