0API.DEV — 自适应模型层0%
介于你的应用与所有模型之间的自适应层

所有模型 统一接入层 无需重写

一个端点,面向众多模型与供应商。既可以按名字直连某个模型,也可以写 auto,让这一层读懂请求并替你选。模型世界不停变,你的集成不用动。

01 — 为什么需要这一层

模型月月变应用不必变

每隔几周就有新的前沿模型发布,干每件事的最优工具一直在换。把某一家供应商硬编码进你的技术栈,意味着排行榜每翻一次你就要重新集成一次。0api 站在中间:对你的代码是一个不动的接口,底下却始终保持最新。

1
base_url — 集成的全部
0
模型更替时需要的重写
5
原生识别的语言
1M
每档都是百万上下文
02 — 今天就能用的

一次接入多种模型

不是让你维护四十个模型的菜单,也不是黑盒。可以直连某个模型,也可以把选择交给 auto。无论哪种:一个端点、一把 Key、一张账单。

01 / 接入

所有模型,一个入口

一个 OpenAI 兼容端点,背后是多家供应商、多个模型家族。可以按名字钉住 kimi-k3,换模型只改一个字符串——永远不用换 SDK。

02 / 决策

不想选,就用 auto

发送 model=auto,路由器会用五种语言读懂任务意图、衡量上下文长度,在请求经过的瞬间选好车道。显式指定模型名则永远直通。两种方式共用同一把 Key。

03 / 观测

每次路由都可查

每个经过路由的响应都带三个可审计的响应头:路由器选了哪一档、实际由哪个模型服务、思维上下文是否完成回填。这不是营销话术——是真实的响应头。 X-Manifest-Tier · X-TokenHub-Served-Model · X-TokenHub-Reasoning-Restore

04 / 延续

推理上下文延续

Kimi、GLM、DeepSeek 在多轮工具调用里都要求把思维上下文传回来——而多数客户端会弄丢它。0api 在代理层把它补回,让 Agent 会话在任何客户端下都保持连贯。基于精确会话匹配;匹配不上就安全透传,绝不编造隐藏的思维过程。

03 — 不是承诺,是证明

看看路由器如何判断

智能路由是这一层交付的第一个能力——今天就在线上跑,不是路线图上的一页。灰点是进来的请求。亮起的那一刻,路由器已经完成了任务评估、选好了车道。

0api 路由器 — 演示
04 — 五语原生

你的语言就是接口

大多数路由层只读英文,其他语言都要先翻译一道——意图就在这一道里丢了。0api 用五种语言原生分类任务意图,今天已在生产环境运行。我们还没见过第二家路由层把这个真正做出来。

EN这个正则表达式做什么?SIMPLE
JAこの関数のユニットテストを書いてSTANDARD
KO이 500줄짜리 서비스를 리팩터링해줘 — 인터페이스는 그대로COMPLEX
THช่วยวิเคราะห์ว่าทำไมโค้ดนี้เมมโมรีรั่วREASONING
ZH把这张架构图转成 MermaidMULTIMODAL

五种文字、五种负载、五条不同的车道——意图原生读取,不经翻译。今天这是经真实公网流量验证的高置信规则基线;完整的自然语言理解在下方路线图里。

05 — 四条车道

今日所需全部覆盖

Simple

轻量任务

翻译、格式化、快问快答。即时,而且几乎免费。

Standard

日常任务

日常编码、文档、摘要。主力车道。

Complex

复杂任务

大型重构、多文件生成、长上下文。代码旗舰。

Reasoning

深度推理

棘手的调试、数学、架构设计。刻意慢想。

所有文本档位都跑在 100 万 token 的上下文窗口上。图像与多模态请求走同一条媒体车道,音频有自己的专属车道——同一个端点,同一把 Key。

06 — 它要去哪

专为越用越好而生

你今天接入的端点,是一个自适应系统的第一层。这里是每个部分的真实状态——哪些已上线,哪些在构建,哪些只是方向。

01 / 已上线

统一接入+智能路由

OpenAI 兼容端点、模型直连、auto 路由、可审计的响应头、多轮 Agent 的思维连续性。这条线以上的一切,就是你在本页看到的——今天都在生产环境运行。

02 / 已上线

五语意图分类

英语、日语、韩语、泰语、中文。路由器在每种语言里原生读取任务意图——分得清"解释一个概念"和"证明、对比、评审"——已经真实公网流量验证。今天这是高置信规则基线,还不是完整的自然语言理解;那是下一行的事。

03 / 下一步

路由从流量学习

每个被路由的请求都会产生信号:路由器预测了什么,实际发生了什么。计划是用这些真实使用数据训练分类器,在数据证明更优的地方逐步替换手写规则。

04 / 方向

闭环反馈

使用信号反哺模型适配:这一层不只是挑模型,而是让模型为你实际发来的工作变得更好。这是系统设计上的方向,不是一个发货日期。

07 — 定价

按量付费或按月订阅

按量付费:auto 每 100 万输入 token $1.40(缓存命中 $0.42),输出 $4.40。订阅则按这个目录价追加每月 auto 额度。只需记住一条规则:额度只覆盖 auto——指定模型的调用一律按 PAYG 单价从钱包余额扣费。

Starter
$15 /月
  • 每月 $30 auto 额度
  • 3 路并发
  • 额度用尽后按 PAYG 单价从钱包余额扣费
申请使用
Pro
$50 /月
  • 每月 $125 auto 额度
  • 6 路并发
  • 同样的模型,更大的余量
申请使用
Max
$200 /月
  • 每月 $600 auto 额度
  • 12 路并发
  • 为重度 Agent 集群准备
申请使用

Beta 定价——名额上限 50 位,逐一人工开通。窗口、滚存、首月赠送和公平使用规则:查看完整定价 →

08 — 快速开始

只需三十秒无需重构

curl https://api.0api.dev/v1/chat/completions \
  -H "Authorization: Bearer $ZAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"auto","messages":[{"role":"user","content":"hey"}]}'
# or pin one by name: "model":"kimi-k3"

一次接入永远保持最新

一把 Key、一个端点——背后有一层替你追着模型跑,你不用自己追。

申请 Beta 资格

已经有 Key?去 Quickstart →