资讯 告别 Token 焦虑!手把手教你聚合免费大模型额度,OpenRouter / NVIDIA / Agnes 全搞定

2026-08-26 15:23:53 views 13

告别 Token 焦虑!手把手教你聚合免费大模型额度,OpenRouter / NVIDIA / Agnes 全搞定

作为 AI 应用开发者,最怕的不是模型效果不行,而是跑着跑着 token 没了。每天省吃俭用,看着余额一点点归零,心里那个慌啊。

别急,今天给大家分享一个“薅羊毛”利器——freellmapi。它能把 OpenRouter、NVIDIA、Agnes 等平台提供的免费 token 额度全部聚合到一个入口,让你一个 API Key 打通所有免费模型,妥妥的开发者福音。

下面是保姆级教程,跟着做,立刻开启 Token 自由模式。


第一步:安装 freellmapi

首先,从 GitHub 拉取项目:

git clone https://github.com/tashfeenahmed/freellmapi

根据仓库的 README 说明安装依赖并启动服务。启动之后,你会得到一个本地 API 地址,默认是 http://127.0.0.1:31415/v1


第二步:绑定免费 Provider,把额度“搬”进来

freellmapi 的魅力在于它支持多平台汇聚。目前最给力的三个免费来源是:

1. NVIDIA NIM

NVIDIA NGC 官网 注册账号并申请 API Key。NVIDIA 提供 40 RPM(每分钟请求数) 的免费额度,模型包括 Llama 3.1、DeepSeek V4 Pro、Mistral Large 等,质量相当能打。

2. OpenRouter

直接访问 openrouter.ai 注册即可。免费模型非常多,像 Qwen3 Coder、GPT-OSS 120B 等大模型都能白嫖。不过要注意,免费模型一般有 6.0M/月120.0M/月 的额度限制(看具体模型)。

3. Agnes(大善人)

Agnes AI 被称为“大善人”不是没道理的——它提供文本、图像、视频等多种大模型的免费接口,而且基础额度相当慷慨。注册后在控制台找到 API Key 即可。


第三步:配置 Agent,接入免费“总闸”

拿到各个平台的 Key 之后,把它们填进 freellmapi 的后台配置里。配置完成后,你会获得一个统一的 API 密钥(类似 freellmapi-d9…)。

接下来,在你的 AI 应用或 Agent 中,把 Base URL 设置为:

http://127.0.0.1:31415/v1

API Key 填刚才生成的统一密钥。

模型选择上,直接填 auto 或者选一个你想要的模型 ID(比如 nvidia/nemotron-3-super-120b-a12b)。freellmapi 会自动帮你路由到对应免费的 provider。


第四步:用 CC Switch 锦上添花

如果你平时使用 CC Switch(一个非常方便的多模型切换工具),可以把 freellmapi 的 Base URLAPI Key 添加进去。这样你可以在不同免费模型之间一键切换,再也不用频繁改配置了。


效果实测,真香

看后台 Dashboard,今日请求 68 次,成功率达 90%,消耗 token 1.5M。而每月总免费额度高达 334.5M,只用了一点点。模型列表中,甚至能直接用上 Qwen3 Coder 480B 这种超强模型,配合 auto 模式,体验非常丝滑。


温馨提示

  • NVIDIA 和 OpenRouter 的免费额度有每月/每分钟限制,注意在后台查看剩余量。
  • 建议在 Agent 里开启模型自动降级,在额度用尽时自动切换备用模型。
  • freellmapi 默认本地运行,请留意安全设置,不要暴露到公网。
  • 免费额度的稳定性可能不如付费 API,涉及重要业务时记得加个双保险。

结语

有了 freellmapi 的加持,免费 token 额度就像自助餐一样,随便吃,还管够。对于日常开发、原型验证、学习探索来说,这波“白嫖”操作绝对是加分项。赶紧装上试试,从此告别 token 焦虑,把精力放在更有价值的事情上!

如果你在配置过程中遇到问题,欢迎在评论区一起交流~

复制全文 生成海报 AI工具 免费API 大模型 token

推荐文章

程序员茄子在线接单