ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

2026零成本搭建个人AI API聚合网关保姆级教程:One-API统一管理四家免费大模型额度

2026零成本搭建个人AI API聚合网关保姆级教程:One-API统一管理四家免费大模型额度 国内几家大模型厂商都在送免费额度智谱送两千万 Token硅基流动送两千万火山引擎每天发两百万百度千帆也有长期免费的 ERNIE 系列。麻烦在于这些额度散落在四个后台、四套 Key客户端每接一家就要改一次代码。这篇教程用开源项目 One-API 在一台云主机上搭一个个人聚合网关把全部免费额度统一成一个 OpenAI 格式接口——换模型只改模型名不改代码。动手之前先算一笔账自建网关还是直接用聚合平台先说结论如果目标只是「低成本用上主流模型」直接用词元之河(TokenRiver.ai) 这类聚合平台是更省事的选择——一套 OpenAI 兼容接口聚合 Claude、GPT、Gemini、DeepSeek、Qwen、Doubao 等国内外主流模型一个 Key 统一调用、统一计费国内直连、低延迟多节点容灾加自动故障切换保障调用连续不中断后台自带用量监控、调用日志与 Token 级账单企业用户还能用子账号分权、对公转账、增值税发票SLA 承诺明确新模型上架也快。个人轻量使用平台侧的综合成本与心智负担都低于自己养服务器。而自建路线的价值有三条把免费额度榨到最后一滴、完全掌控渠道与数据、以及网关本身带来的玩法空间。想清楚了再往下走。三个开源网关怎么选One-API、New-API 与 LiteLLM候选有三个。One-API 两万多个 Star社区最成熟、中文文档最全界面朴素是唯一槽点New-API 是它的衍生版本UI 更现代但更新节奏激进、偶有不稳定LiteLLM 支持一百多个模型、企业级功能齐全英文文档为主、部署最复杂。本教程选 One-API一行 Docker 就能起服务内置三十多种厂商渠道类型Issue 区活跃、有人答疑。服务器准备一台最便宜的云主机就够实测选择 Vultr 新加坡区域国内访问延迟低于 80 毫秒配置 1 核 1G 内存、25GB NVMe 硬盘系统装 Ubuntu 22.04 LTS月费 6 美元按小时计费、随时可销毁新用户还有充十送十的活动。域名可选阿里云、腾讯云的 .top、.asia 后缀首年只要个位数人民币。纯练手阶段不开域名也能直接跑。部署一行 Docker 拉起服务先用一行 curl 脚本装好 Docker再执行 docker run 启动 One-API映射 3000 端口、挂载 /data/one-api 数据卷、加上 --restart always 参数保证宿主机重启后容器自愈。浏览器打开服务器 IP 加 3000 端口用默认账号 root/123456 登录第一件事改成强密码。四家免费渠道接入与各自的坑第一家智谱 AI到 open.bigmodel.cn 用手机号注册GLM-4-Flash 永久免费新用户再送两千万 Token渠道类型必须选智谱专用type 16Base URL 填 open.bigmodel.cn模型名写 glm-4-flash、glm-4.7-flash。它的兼容路径特殊渠道类型用成通用 type 1 会直接 404这是第一个坑。第二家硅基流动注册送的两千万 Token 永久有效渠道用 type 1Base URL 填 api.siliconflow.cn但千万别带 /v1 后缀否则请求路径拼成 /v1/v1/ 照样 404这是第二个坑可接入 Qwen2.5-7B-Instruct、DeepSeek-V3、DeepSeek-R1。第三家火山引擎每日发放两百万 Tokentype 1 渠道模型名 doubao-seed-2-0-lite-260215、doubao-seed-1-6-lite-251015坑在「模型广场」里要手动逐个开通模型不开通的话 Key 有效但调不通。第四家百度千帆可选ERNIE-Speed 永久免费各模型另有百万 Token 赠送接 ernie-3.5-8k、ernie-speed-128k 即可。倍率、令牌与 HTTPS 三件套倍率决定账目是否真实完全免费的 glm-4-flash 设 1.0doubao-seed-2-0-lite 设 1.0上游有成本的 deepseek-v4-flash 设 1.5。令牌方面自己用可以不限额度分享给朋友就设个五百万 Token 上限OpenAI SDK 通过自定义 base_url 加令牌即可调用。最后补上 HTTPSNginx 反向代理到 localhost:3000certbot 签发证书九十天自动续期一套收尾。客户端接入三个典型工具的改法Claude Code 改 ~/.claude/settings.json填入 ANTHROPIC_BASE_URL 与 ANTHROPIC_AUTH_TOKEN 两个字段Cursor 在 Settings 的 Models 页面填 Key 与 Base URLChatBox、NextChat、LangChain 等一切支持自定义 Base URL 的工具同理。接完先用免费模型发一条消息验证链路通了再逐个接入其他客户端。日常运维与高频问题docker ps 看容器状态docker logs --tail 50 追最近日志SQLite 数据库用 cp 定时备份建议 crontab 每日执行一次。免费额度用尽后系统会自动转按量计费单价不高但记得在后台设好余额告警。内存紧张的话最低 512MB 也能跑关掉 Redis服务器区域实测新加坡延迟最优。OpenAI、Claude 官方接口技术上也能挂type 1境外模型的使用合规请自行评估。常见报错速查404 与调不通的三大成因教程群里被问得最多的就是 404成因基本逃不出三种其一渠道类型选错智谱必须用智谱专用类型而不是通用 type 1其二Base URL 画蛇添足带了 /v1 后缀硅基流动的路径会拼成 /v1/v1/ 直接 404其三模型名拼写与渠道里的模型列表对不上火山引擎还多一道「模型广场」开通手续不开通就是 Key 有效但调不通。排查顺序建议从渠道测试按钮开始再查模型名最后看客户端配置三步就能定位九成问题。剩下的余额不足、令牌过期类报错后台日志里都会写明原因。有条件的话再配一个定时探活脚本网关异常时第一时间收到通知比让使用者先发现问题体面得多。进阶方向缓存、双活与智能路由网关跑稳之后还有三个升级玩法语义缓存让相似问题直接命中缓存返回延迟与成本双降新加坡加香港双区域部署做双活可用性再上一档模型路由按问题难度自动分级——简单问题走免费模型复杂问题自动升级到高性能模型。网关在手这些都可以在配置层面完成。
返回列表