FreeLLMAPI开源网关:聚合34家免费额度
FreeLLMAPI 是一个 MIT 协议的自托管开源网关,把 Google、Groq、Mistral、OpenRouter 等 34 家厂商的免费大模型额度汇总成一个 OpenAI 兼容接口,并自动处理限流、路由与记账,支持本地部署和自定义端点,是免费额度集中调用的实用方案。
目前主流大模型厂商大多设置了免费额度,但各家的规模、限流规则和重置时间完全不同。单独看,很多额度只够做小实验;如果把 34 家的额度叠加起来,才具备支撑实际业务的量级。FreeLLMAPI 是一个 MIT 协议的自托管开源 API 网关,把这 34 家免费额度收拢到一个 OpenAI 兼容接口后面,应用只需对接一次,路由、避限流、记账都交给网关处理。

免费额度池有多大
FreeLLMAPI 目前聚合了 34 个免费提供商、474 个模型家族、635 个免费端点,其中对话模型 584 个,embedding 41 个,语音转写 7 个,视频生成 3 个。名单覆盖 Google、Groq、Cerebras、Mistral、OpenRouter、Cloudflare、Cohere、NVIDIA、HuggingFace、Z.ai、ModelScope 等。
除了内置提供商,它也能挂自定义端点。任何 OpenAI 兼容服务都可以接入,例如 llama.cpp、LM Studio、vLLM 或本地 Ollama。
限流与路由
免费额度的限制通常按分钟或天计算请求次数和 token,有的还叠加月度总量预算,人工很难盯住。FreeLLMAPI 会为每把 key 在每个模型上单独记账,选择模型前先查余额,快用尽的模型自动跳过。
请求里把 model 填成 auto,网关会根据实时速度、能力和可靠性评分挑选当前最合适的模型。路由策略提供六种,常用的是 fastest、smartest、reliable,也可以按单次请求临时指定,写成 auto:fast 或 auto:smart。
应对免费市场的不确定性
免费模型上下架和额度调整很频繁。FreeLLMAPI 每天拉取两次带签名的目录,新模型、额度变动和兼容性修复会自动生效,不需要手动升级,避免模型清单快速过时。
不止聊天
除了对话,它还提供图片生成、视频生成、语音合成、语音转写和 embedding 等接口,工具调用与结构化输出参数同样支持。
值得关注的是 fusion 虚拟模型:它会将同一个问题分发给一组不同的免费模型,各自生成草稿后,再由一个裁判模型合成最终答案。如果拿不准哪家模型更可靠,可以让多个模型一起“开会”。

部署与使用
FreeLLMAPI 是 Node 项目,Node 20 以上即可运行,Windows、macOS、Linux 服务器和树莓派都能跑,闲时内存占用约 40MB。最省事的安装方式是通过脚本安装(需要 Docker):
curl -fsSL https://freellmapi.co/install.sh | bash
首次启动后访问 localhost:3001,设置邮箱和管理密码;之后在 Keys 页面填入各家 API Key,按偏好调整模型优先级,再取走统一 API Key。应用端将 base_url 指向 localhost:3001/v1,model 填 auto,剩下的交给网关。每次响应都会带 X-Routed-Via 标记,标明实际来自哪家哪款模型。
不想操作终端的用户可用桌面版,支持 macOS 和 Windows,托盘常驻,小弹窗可查看实时请求统计,且不需要设置账号密码。
小结
免费额度一直存在,缺的是把它粘起来的胶水。FreeLLMAPI 把这一层做成了可自托管的开源项目,适合希望统一接入多家免费大模型、又想避开繁琐限流规则的开发者。
项目地址:https://github.com/tashfeenahmed/freellmapi
每款模型的限流、上下文和免费额度也可以在 freellmapi.co/models 页面查看。





暂无评论,期待您的发言...