想要自己动手搭建 AI 应用、测试大模型,却被高昂的 API 计费账单或者 429(请求超限)错误劝退?
折腾过 sub2api 或 newapi 这类传统中转站的都清楚,手动维护不同平台的渠道连通性有多折腾。更关键的是,单独一家的免费额度根本不够用。
FreeLLMAPI 这个项目把从各家平台申请到的免费 API 额度聚合成一个"无限 Token 池",完美兼容 OpenAI 格式。支持自动切换和负载均衡,整合下来每月免费 Token 总量能高达 16 亿。
今天整理市面上最核心的免费 API 获取渠道,手把手教你在 Linux 服务器上部署这套系统。
全网最全免费 API 渠道盘点
1. 核心"正规军"(大厂免费额度)
这 9 个平台是稳定的主力军,建议全部注册:
- Google AI Studio (Gemini):免费额度天花板,支持超长上下文,极高频率调用。
- Groq:自研 LPU 芯片,全网推理速度最快,极低延迟。
- GitHub Models:程序员专属羊毛,有 GitHub 账号即可免费调用 GPT-4o 等顶级模型。
- OpenRouter:最强聚合平台的"Free Models"专区,常有限免惊喜。
- Mistral AI:欧洲之光,提供优质的免费 Experiment 试用计划。
- Together AI:最强开源云算力,注册赠送额度,部分小参数模型完全免费。
- NVIDIA NIM:英伟达官方免费算力,跑分极高,适合高强度逻辑测试。
- Cohere:RAG 与文本专家,开发者永久免费试用 Key。
- Hugging Face Inference:开源社区大本营,海量模型免部署直接调用。
2. 速度型选手
3. 边缘计算 & 国产方案
- Cloudflare Workers AI:白嫖 Cloudflare 遍布全球的边缘计算节点。需要在控制台"Workers & Pages → AI"板块生成 API Token。
- 智谱 AI (Zhipu AI):国产大模型的绝对第一梯队(GLM 系列)。新用户注册送海量 Token,GLM-4-Flash 等小参数模型经常开放完全免费调用。
- Ollama Cloud:云端 Ollama 服务,方便管理本地模型。
服务器部署
把上面的 Key 准备好后,直接在 Linux 服务器(Debian/Ubuntu 为例)上把这个聚合系统跑起来。项目基于 Node.js,自带 SQLite 数据库,部署非常轻量。
第一步:环境准备与基础安装
如果你刚拿到一台纯净服务器(Ubuntu / Debian),先装好必备的运行环境:Git(拉取代码)和 Node.js(运行项目)。
1. 更新系统并安装 Git
| |
2. 安装 Node.js(核心:安装 v20+ 最新版)
Linux 系统默认源自带的 Node.js 版本通常太老。通过 NodeSource 官方源安装推荐的 20.x 版本:
| |
3. 验证安装结果
| |
第二步:克隆项目与拉取依赖
| |
第三步:配置 Systemctl 后台守护进程
关掉 SSH 终端后服务不断线,需要挂载为系统后台服务,实现 24 小时稳定运行及开机自启。
- 创建服务配置文件:
| |
- 填入以下配置:
| |
(注意:确保 WorkingDirectory 是你实际克隆代码的路径)
- 启动并设置开机自启:
| |
大功告成!浏览器访问 http://你的服务器IP:3001,进入管理后台填入你所有的 Key。系统会自动为你生成唯一的令牌,并开启降级路由(Fallback Chain):一旦某个渠道遇到限流或宕机,自动无缝切换到下一个可用节点,你的业务永不断线。
更新步骤
后续更新只需三步,无需重配环境:
| |
如果你在搭建过程中遇到问题,可以去原作者的 YouTube 频道 看配套的视频教程,里面有每一步的详细操作演示。
也可以加入 Telegram 群 交流。
