🔄 更新于 2026-09-17。这是我自建的 AI 大模型 API 中转站,跑的是开源项目 New API。它把十几家上游供应商统一成一套 OpenAI 兼容接口,一把密钥调用所有模型。DeepSeek V4.1 Flash 系列现在有半价分组(5 折),见第四节。
🔌 想直接接客户端用? Claude Code、Codex、pi、openclaw 的完整配置、base_url 到底该不该带
/v1、以及几个必踩的坑,都整理在这篇:客户端接入指南:Claude Code / Codex / pi / openclaw
一、这是什么#
一句话:一个自建的大模型 API 网关,入口是 https://new-api.hsfp.cn。
它把这些上游——官方直连、云厂商、聚合与中转,以及我自己那两张 4090 上跑的本地模型——聚合成一个出口:
一个地址:
https://new-api.hsfp.cn/v1,OpenAI 兼容一把密钥:在站内建一个令牌,就能调用全部模型
一套接口:
/v1/chat/completions、/v1/responses、/v1/messages(Claude 格式)都通,流式、工具调用、思维链(reasoning_content)、缓存命中计费都有一份账:每个令牌独立额度,每笔调用的 tokens 与扣费在控制台里逐条可查
实际用途是给各种客户端当统一出口:Cherry Studio、NextChat、Chatbox、Claude Code、浏览器插件、自己写的脚本——改 base_url 和 api_key 两个字段就能接上,不用为每家的 key 维护一套配置。
同一个模型名可能由不同上游提供(比如 deepseek-v4-flash 同时挂在好几个上游上),某个上游挂了会自动换一个,对调用方是透明的。
二、怎么开始用#
1. 登录#
站点不开放自助注册(注册入口已关闭),只走单点登录:用 hsfp.cn 的通行证(Authentik)点一下「点击登录」就进来了。需要账号找我开。
2. 建一个令牌#
登录后进 控制台 → 令牌 → 添加令牌,只有两项要想清楚:
分组:决定你能用哪些模型、按什么倍率扣费。见第四节的「deepseek半价组」。
模型限制(可选):留空 = 该分组下的模型全都能用;填了就只有列出的模型能用。
令牌是一串 sk- 开头的密钥,只在创建时完整显示,记得复制下来。
3. 调用#
base_url 填 https://new-api.hsfp.cn/v1(注意带 /v1),key 填令牌:
curl https://new-api.hsfp.cn/v1/chat/completions \
-H "Authorization: Bearer sk-你的令牌" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4.1-flash",
"messages": [{"role": "user", "content": "用一句话介绍你自己"}],
"stream": true
}'Python 用官方 SDK 就是换两个参数:
from openai import OpenAI
client = OpenAI(
base_url="https://new-api.hsfp.cn/v1",
api_key="sk-你的令牌",
)
resp = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)4. 各种客户端的接法#
上面这个 https://new-api.hsfp.cn/v1 是给 OpenAI 兼容客户端用的。Anthropic 系的客户端(Claude Code、pi 的 anthropic 模式)不要带 /v1,填 https://new-api.hsfp.cn 就行——它们自己会拼 /v1/messages,多一层就 404。
| 客户端 | base_url 填什么 |
|---|---|
| Claude Code / Anthropic SDK | https://new-api.hsfp.cn |
| Codex CLI | https://new-api.hsfp.cn/v1 |
| Cherry Studio / Chatbox / pi / openclaw | https://new-api.hsfp.cn/v1 |
逐个客户端的完整配置(Claude Code 的环境变量、Codex 的 config.toml、pi 和 openclaw 的 models.json)和几个必踩的坑,单独整理了一篇:客户端接入指南:Claude Code / Codex / pi / openclaw
三、有哪些模型#
| 类别 | 模型 |
|---|---|
| 🔥 DeepSeek | deepseek-v4.1-flash、deepseek-flash、deepseek-v4-flash、deepseek-v4-flash-vision-exp、deepseek-v4-pro |
| GPT 系列 | gpt-5.5、gpt-5.4、gpt-5.2、gpt-5.1、gpt-5、gpt-image-2(画图) |
| 国产模型 | glm-5.3、glm-5.2、kimi-k3、kimi-k3-256、kimi-k2.7-code、minimax-m3、doubao-seed-2.1-turbo、ark-code-latest |
| 本地自建 | qwen3.8-27b(自己的 4090)、muse-glimmer-30b、qwen3-embedding-4b |
| 免费模型 | free-auto(自动挑一个免费模型)、auto,以及若干标价 0 的模型 |
完整列表与实时价格看登录后的模型广场页面。
四、半价分组:DeepSeek Flash 5 折#
2026-09 加了一个只放 DeepSeek Flash 系列的分组,倍率 0.5——也就是默认分组价格的一半:
| 模型 | 默认分组(输入 / 输出,每百万 tokens) | deepseek半价组 |
|---|---|---|
deepseek-v4.1-flash | $0.15 / $0.60 | $0.075 / $0.30 |
deepseek-flash | $0.15 / $0.60 | $0.075 / $0.30 |
deepseek-v4-flash | $0.15 / $0.60 | $0.075 / $0.30 |
deepseek-v4-flash-vision-exp | $0.15 / $0.60 | $0.075 / $0.30 |
deepseek-v4-pro | $0.66 / $1.98 | ❌ 不在这个分组里 |
怎么用:建令牌时分组选「deepseek半价组」(编辑已有令牌也能改)。分组是令牌级的,一个令牌一个分组。
两个注意点:
这个分组只有上面那 4 个 Flash 模型。拿它去调
deepseek-v4-pro或别的模型会报错——要全模型就用「默认分组」。deepseek-flash、deepseek-v4-flash、deepseek-v4-flash-vision-exp是同一代 Flash 的不同别名/版本,价格一样,按客户端里习惯的名字填就行。
五、计费怎么算#
扣费 = 输入 tokens × 模型倍率 × 分组倍率 + 输出 tokens × 模型倍率 × 输出倍率 × 分组倍率本站的换算基准是 倍率 1 = $2 / 百万 tokens 输入。缓存命中的输入按很低的倍率计(DeepSeek 系列是输入价的 2%),响应 usage 里能看到 prompt_cache_hit_tokens / prompt_cache_miss_tokens。
面板显示的是人民币(汇率按 6.98 折算),日志里能看到每一笔的输入/输出 tokens 和实际扣费。这也是我做这个站的原因之一:每一分钱花在哪看得见。
六、关于 New API#
本站跑的开源项目 New API 是个用 Go 写的大模型网关,前端 React,单二进制部署,数据库支持 SQLite / MySQL / PostgreSQL,可选 Redis 做缓存与限流。主要能力:
多上游渠道:内置 40 个供应商适配(OpenAI、Claude、Gemini、Azure、AWS Bedrock、火山、阿里、智谱、DeepSeek…),也能接任意 OpenAI 兼容的自定义上游
多用户 + 令牌体系:用户、令牌、额度、分组倍率、模型白名单、过期时间、模型级限流
运营能力:分组与模型倍率、失败重试与自动禁用、渠道健康检查、请求日志与用量统计、多机部署
协议兼容:OpenAI Chat Completions / Responses、Claude Messages、Gemini、图片、Embedding、Rerank、视频任务(Sora、可灵、即梦、海螺等)
项目地址:https://github.com/QuantumNous/new-api,官方文档:https://docs.newapi.pro。
我自己还改过它的一些计费细节(把 DeepSeek 的价格校准到官方口径、加了这个半价分组),这部分见 我的自托管折腾清单。
七、常见问题#
报「无权使用该模型」或者 503? 多半是令牌分组和模型对不上。半价分组只有 DeepSeek Flash 系列,换成「默认分组」再试。
为什么没有注册入口? 对,注册已关闭,只保留单点登录——这站是给自己和朋友用的。
能看到我调了什么吗? 日志只记模型、tokens 和扣费,用来对账。不过还是要说清楚:这是自建服务不是加密黑箱,别把不该外发的数据发进来。
额度怎么加? 找我。
讨论 0
还没有人说话。
登录登录后可以参与讨论