模型中转站

AI 速览6 天前更新

作者自建了一个基于开源项目 New API 的大模型 API 中转站,把官方直连、云厂商、聚合中转以及自己 4090 上的本地模型统一成一套 OpenAI 兼容接口,一把密钥即可调用全部模型,并给出登录、建令牌、调用与各客户端 base_url 的接法。站点不开放注册,只走单点登录。值得注意的细节:DeepSeek Flash 系列有 5 折分组,但该分组只含 4 个 Flash 模型,调其他模型会报错;Anthropic 系客户端填 base_url 时不要带 /v1;日志只记录模型、tokens 和扣费,作者提醒不要发送不宜外发的数据。

🔄 更新于 2026-09-17。这是我自建的 AI 大模型 API 中转站,跑的是开源项目 New API。它把十几家上游供应商统一成一套 OpenAI 兼容接口,一把密钥调用所有模型。DeepSeek V4.1 Flash 系列现在有半价分组(5 折),见第四节。

🔌 想直接接客户端用? Claude Code、Codex、pi、openclaw 的完整配置、base_url 到底该不该带 /v1、以及几个必踩的坑,都整理在这篇:客户端接入指南:Claude Code / Codex / pi / openclaw

一、这是什么#

一句话:一个自建的大模型 API 网关,入口是 https://new-api.hsfp.cn

它把这些上游——官方直连、云厂商、聚合与中转,以及我自己那两张 4090 上跑的本地模型——聚合成一个出口:

  • 一个地址https://new-api.hsfp.cn/v1,OpenAI 兼容

  • 一把密钥:在站内建一个令牌,就能调用全部模型

  • 一套接口/v1/chat/completions/v1/responses/v1/messages(Claude 格式)都通,流式、工具调用、思维链(reasoning_content)、缓存命中计费都有

  • 一份账:每个令牌独立额度,每笔调用的 tokens 与扣费在控制台里逐条可查

实际用途是给各种客户端当统一出口:Cherry Studio、NextChat、Chatbox、Claude Code、浏览器插件、自己写的脚本——改 base_urlapi_key 两个字段就能接上,不用为每家的 key 维护一套配置。

同一个模型名可能由不同上游提供(比如 deepseek-v4-flash 同时挂在好几个上游上),某个上游挂了会自动换一个,对调用方是透明的。

二、怎么开始用#

1. 登录#

站点不开放自助注册(注册入口已关闭),只走单点登录:用 hsfp.cn 的通行证(Authentik)点一下「点击登录」就进来了。需要账号找我开。

2. 建一个令牌#

登录后进 控制台 → 令牌 → 添加令牌,只有两项要想清楚:

  • 分组:决定你能用哪些模型、按什么倍率扣费。见第四节的「deepseek半价组」。

  • 模型限制(可选):留空 = 该分组下的模型全都能用;填了就只有列出的模型能用。

令牌是一串 sk- 开头的密钥,只在创建时完整显示,记得复制下来。

3. 调用#

base_url 填 https://new-api.hsfp.cn/v1(注意带 /v1),key 填令牌:

curl https://new-api.hsfp.cn/v1/chat/completions \
  -H "Authorization: Bearer sk-你的令牌" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4.1-flash",
    "messages": [{"role": "user", "content": "用一句话介绍你自己"}],
    "stream": true
  }'

Python 用官方 SDK 就是换两个参数:

from openai import OpenAI

client = OpenAI(
    base_url="https://new-api.hsfp.cn/v1",
    api_key="sk-你的令牌",
)
resp = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

4. 各种客户端的接法#

上面这个 https://new-api.hsfp.cn/v1 是给 OpenAI 兼容客户端用的。Anthropic 系的客户端(Claude Code、pi 的 anthropic 模式)不要带 /v1,填 https://new-api.hsfp.cn 就行——它们自己会拼 /v1/messages,多一层就 404。

客户端base_url 填什么
Claude Code / Anthropic SDKhttps://new-api.hsfp.cn
Codex CLIhttps://new-api.hsfp.cn/v1
Cherry Studio / Chatbox / pi / openclawhttps://new-api.hsfp.cn/v1

逐个客户端的完整配置(Claude Code 的环境变量、Codex 的 config.toml、pi 和 openclaw 的 models.json)和几个必踩的坑,单独整理了一篇:客户端接入指南:Claude Code / Codex / pi / openclaw

三、有哪些模型#

类别模型
🔥 DeepSeekdeepseek-v4.1-flashdeepseek-flashdeepseek-v4-flashdeepseek-v4-flash-vision-expdeepseek-v4-pro
GPT 系列gpt-5.5gpt-5.4gpt-5.2gpt-5.1gpt-5gpt-image-2(画图)
国产模型glm-5.3glm-5.2kimi-k3kimi-k3-256kimi-k2.7-codeminimax-m3doubao-seed-2.1-turboark-code-latest
本地自建qwen3.8-27b(自己的 4090)、muse-glimmer-30bqwen3-embedding-4b
免费模型free-auto(自动挑一个免费模型)、auto,以及若干标价 0 的模型

完整列表与实时价格看登录后的模型广场页面。

四、半价分组:DeepSeek Flash 5 折#

2026-09 加了一个只放 DeepSeek Flash 系列的分组,倍率 0.5——也就是默认分组价格的一半:

模型默认分组(输入 / 输出,每百万 tokens)deepseek半价组
deepseek-v4.1-flash$0.15 / $0.60$0.075 / $0.30
deepseek-flash$0.15 / $0.60$0.075 / $0.30
deepseek-v4-flash$0.15 / $0.60$0.075 / $0.30
deepseek-v4-flash-vision-exp$0.15 / $0.60$0.075 / $0.30
deepseek-v4-pro$0.66 / $1.98❌ 不在这个分组里

怎么用:建令牌时分组选「deepseek半价组」(编辑已有令牌也能改)。分组是令牌级的,一个令牌一个分组。

两个注意点:

  1. 这个分组只有上面那 4 个 Flash 模型。拿它去调 deepseek-v4-pro 或别的模型会报错——要全模型就用「默认分组」。

  2. deepseek-flashdeepseek-v4-flashdeepseek-v4-flash-vision-exp 是同一代 Flash 的不同别名/版本,价格一样,按客户端里习惯的名字填就行。

五、计费怎么算#

扣费 = 输入 tokens × 模型倍率 × 分组倍率 + 输出 tokens × 模型倍率 × 输出倍率 × 分组倍率

本站的换算基准是 倍率 1 = $2 / 百万 tokens 输入。缓存命中的输入按很低的倍率计(DeepSeek 系列是输入价的 2%),响应 usage 里能看到 prompt_cache_hit_tokens / prompt_cache_miss_tokens

面板显示的是人民币(汇率按 6.98 折算),日志里能看到每一笔的输入/输出 tokens 和实际扣费。这也是我做这个站的原因之一:每一分钱花在哪看得见

六、关于 New API#

本站跑的开源项目 New API 是个用 Go 写的大模型网关,前端 React,单二进制部署,数据库支持 SQLite / MySQL / PostgreSQL,可选 Redis 做缓存与限流。主要能力:

  • 多上游渠道:内置 40 个供应商适配(OpenAI、Claude、Gemini、Azure、AWS Bedrock、火山、阿里、智谱、DeepSeek…),也能接任意 OpenAI 兼容的自定义上游

  • 多用户 + 令牌体系:用户、令牌、额度、分组倍率、模型白名单、过期时间、模型级限流

  • 运营能力:分组与模型倍率、失败重试与自动禁用、渠道健康检查、请求日志与用量统计、多机部署

  • 协议兼容:OpenAI Chat Completions / Responses、Claude Messages、Gemini、图片、Embedding、Rerank、视频任务(Sora、可灵、即梦、海螺等)

项目地址:https://github.com/QuantumNous/new-api,官方文档:https://docs.newapi.pro

我自己还改过它的一些计费细节(把 DeepSeek 的价格校准到官方口径、加了这个半价分组),这部分见 我的自托管折腾清单

七、常见问题#

报「无权使用该模型」或者 503? 多半是令牌分组和模型对不上。半价分组只有 DeepSeek Flash 系列,换成「默认分组」再试。

为什么没有注册入口? 对,注册已关闭,只保留单点登录——这站是给自己和朋友用的。

能看到我调了什么吗? 日志只记模型、tokens 和扣费,用来对账。不过还是要说清楚:这是自建服务不是加密黑箱,别把不该外发的数据发进来。

额度怎么加? 找我。

引用这篇的地方 1

讨论 0

还没有人说话。

    登录登录后可以参与讨论