Free AI Index / 使用指南

Free-LLM — 免费 AI 与 LLM API 开放目录

来自多个提供商的免费 LLM API、试用额度和本地 / 自托管工具,帮助你几秒钟内发现、比较并开始接入。

参考来源:README.zh-CN.md ↗ 仓库:nejib1/Free-LLM ↗ 许可证:MIT License
01 / why this exists

为什么需要这个项目

找一个免费 LLM API,不应该翻遍十几个更新日志,为了对比速率限制去注册五个不同平台,或者猜测哪个提供商这个月还有免费额度。

这是一份参考型目录:把提供商、模型、限制条件、获取 Key 的入口和接入方式集中到一起。社区维护、信用卡透明、可复制的代码示例和并排比较,是 README 中最值得保留的使用路径。

重要:免费额度、地区、验证要求和服务条款会变化。下方内容来自参考 README 的整理快照,实际使用前请打开每行的官方链接再次确认。
02 / start here

三步上手

  1. 选一个提供商:先看下方 Provider Directory;新手可以优先尝试 Groq、Google AI Studio 等清晰标注免费层的入口。
  2. 获取 API Key:打开 Quick Reference 中对应的官方控制台或密钥页面,确认是否需要邮箱、手机或银行卡。
  3. 接入代码:把 Base URL 与模型 ID 填入下面的 OpenAI 兼容示例,并根据官方限制控制速率和用量。

完整提供商详情和社区备注请查看原始项目及各 Provider 官方文档。

03 / quick start

Quick Start — 30 秒接入免费 API

大多数提供商提供 OpenAI 兼容接口。接受 baseURLapiKey 的工具通常只需要替换这两项。

Python(OpenAI SDK)

from openai import OpenAI

client = OpenAI(
    base_url="https://api.groq.com/openai/v1",
    api_key="GROQ_API_KEY",  # 在官方控制台获取
)

response = client.chat.completions.create(
    model="llama-3.3-70b-versatile",
    messages=[{"role": "user", "content": "Hello!"}],
)
print(response.choices[0].message.content)

编程助手

04 / provider directory

Provider Directory

⚡ 永久免费额度

持续免费访问,通常会限速,但不以一次性试用为前提。

提供商需要信用卡?速率限制每日限额月度 / 其他额度主要模型
Google AI Studio ↗5–30 RPM(因模型而异)9,000 RPD(Flash)完全免费Gemini 3.1 Pro / Flash
Mistral ↗需手机验证1 request/secondFreeMistral 7B / Mixtral
Hugging Face Inference ↗300 requests/hour按月度 credits$0.10/月路由 creditsLlama / Qwen / Gemma
Cohere ↗20 requests/minute1,000 requests/monthCommand R / R7B / A
NVIDIA NIM ↗需手机验证40 requests/minute按模型而定
Groq ↗30 RPM14,400 requests/dayFree foreverQwen / Llama / Whisper
Z.AI (GLM) ↗需注册约 1 request/second约 1,000/day持续免费层GLM Flash
Coze ↗需注册因模型而异按 token 计算每日重置GPT / Gemini
Cloudflare Workers AI ↗因模型而异10,000 neurons/day约 300,000 neurons/monthLlama / Mistral / Qwen
LLM7.io ↗30 RPM / 120 RPM最多 5M tokens/dayFree, no billingDeepSeek / Qwen
OVH AI Endpoints ↗需注册2 RPM / 400 RPM未公布Beta accessQwen3Guard / SDXL
Ollama Cloud ↗Light usage tier会话周期重置每周重置GPT-OSS / Qwen / DeepSeek
Nous Portal ↗未完整公布未公布$0/monthHermes 4
Hetzner Inference API ↗按 token 限制500M input / 5M output实验阶段免费Qwen3.6
Pollinations.ai ↗匿名约 1 request/15s合理使用范围FreeGPT / Mistral 类模型
SiliconFlow ↗需手机验证按模型固定限制需登录确认免费模型见官方模型页
ModelScope ↗需手机验证500 requests/day/model2,000 requests/dayFree见官方模型页
Aion Labs ↗未公布每日 token allowanceFree见官方页面
Inference.net ↗30 RPM(合理使用)Fair useFair useDeepSeek / Llama

💰 可续期额度

定期续期的免费额度,不是一次性用完即止。

提供商需要信用卡?速率限制免费额度主要模型
OpenRouter ↗20 requests/minute50 requests/day(充值后更高)Gemini / Llama / NVIDIA
Venice.ai ↗需注册10 RPMLimited daily usageLlama 405B / Dolphin
Requesty ↗60 RPM200 requests/dayFree models
Grok (xAI) ↗需注册视额度而定$25 one-time signup creditGrok 2

🎁 一次性试用额度

注册后获得一次性 credits 或金额,用完为止;部分平台可能要求注册或充值。

提供商注册要求额度有效期
Together.AI ↗需注册需先充值最低 $5
Replicate ↗需注册少量试用额度一次性
Fireworks AI ↗需注册$1一次性
SambaNova Cloud ↗需注册$53 个月
Hyperbolic ↗需注册$1一次性
Nebius Token Factory ↗需注册$1,需银行卡一次性
Cerebras ↗需注册$530 天
Novita AI ↗需注册$0.50一次性
Scaleway Generative APIs ↗需注册1M tokens一次性
Qwen / Alibaba ↗需注册每模型 1M tokens一次性
AI21 Labs ↗需注册$103 个月
Upstage ↗需注册$103 个月
DeepSeek ↗需注册5M tokens30 天
Cerebrium ↗需注册$30一次性
DeepInfra ↗需注册$5一次性,90 天过期
05 / local and self-hosted

本地 / 自托管

本地运行可以获得更强的隐私和可控性,但“模型权重免费”不等于 GPU、存储和推理基础设施免费。

工具类型亮点
Ollama ↗CLI + API100+ 模型、GPU 加速、OpenAI 兼容
LM Studio ↗桌面 GUIGGUF 模型、模型浏览器、离线使用
llama.cpp ↗C/C++ 引擎运行 GGUF,依赖少
GPT4All ↗桌面应用纯 CPU 运行、开源
Jan.ai ↗桌面应用注重隐私、100% 离线
KoboldCpp ↗单文件应用创意写作、支持 GGUF
llamafile ↗跨平台llama.cpp + Cosmopolitan Libc
Text Generation WebUI ↗Gradio 界面高度可定制
BentoML ↗推理平台部署任意 AI/ML 模型
06 / quick reference

Quick Reference — Base URL 与 API Key 速查

下面列出 README 中的代表性入口。Base URL、模型 ID 和 Key 获取地址应以提供商官方文档为准。

提供商Base URL
OpenRouter ↗https://openrouter.ai/api/v1
Google AI Studio ↗https://generativelanguage.googleapis.com/v1beta
Mistral ↗https://api.mistral.ai/v1
Hugging Face ↗https://router.huggingface.co/v1
Fireworks AI ↗https://api.fireworks.ai/inference/v1
NVIDIA NIM ↗https://integrate.api.nvidia.com/v1
Cerebras ↗https://api.cerebras.ai/v1
Groq ↗https://api.groq.com/openai/v1
DeepSeek ↗https://api.deepseek.com/v1
Z.AI (GLM) ↗https://api.z.ai/api/paas/v4
Coze ↗https://api.coze.com/v1
SiliconFlow ↗https://api.siliconflow.com/v1
ModelScope ↗https://api-inference.modelscope.cn/v1
Ollama Cloud ↗https://ollama.com/v1

需要更完整的列表时,请直接查看 原始中文 README ↗

07 / guides and community

使用指南与社区功能

来源边界:本页面借鉴并展示参考 README 的信息结构与部分目录内容;本站自己的 Offer 仍以官方证据和 `data/offers.json` 为准。