通过统一端点访问 OpenAI 和 Claude 模型。或者,无缝接入 DeepSeek 等顶尖替代方案,在零代码修改的情况下将 API 账单削减 90%。
简单透明的定价
文本、图片与视频模型统一展示,按实际用量付费。
| 模型 | 官方 I/O | 输入 | 输出 | 节省 |
|---|---|---|---|---|
| Claude Fable 5.1 | $10 / $50 | $3.40 | $17.00 | 66% |
| Claude Fable 5 | $10 / $50 | $3.40 | $17.00 | 66% |
| Claude Opus 5 | $5 / $25 | $1.70 | $8.50 | 66% |
| Claude Opus 4.8 | $5 / $25 | $1.70 | $8.50 | 66% |
| Claude Opus 4.7 | $5 / $25 | $1.70 | $8.50 | 66% |
| Claude Opus 4.6 | $5 / $25 | $1.70 | $8.50 | 66% |
| Claude Sonnet 4.6 | $3 / $15 | $1.02 | $5.10 | 66% |
| Claude Sonnet 5 | $2 / $10 | $0.68 | $3.40 | 66% |
| Claude Haiku 4.5 | $1 / $5 | $0.34 | $1.70 | 66% |
| gpt-6-astra | $10 / $50 | $0.95 | $4.75 | 80% |
| GPT-5.6 Sol | $5 / $30 | $1.00 | $6.00 | 80% |
| GPT-5.5 | $5 / $30 | $1.00 | $6.00 | 80% |
| GPT-5.4 | $2.5 / $15 | $0.50 | $3.00 | 80% |
| GPT-5.6 Terra | $2 / $12 | $0.40 | $2.40 | 80% |
价格以美元固定计价,实际费用以控制台结算记录为准。
主要地区访问 Tokenhot API 的典型延迟
基于 Globalping 探针的实时测量,每几分钟刷新一次;实际延迟会因本地网络环境而波动。
完全兼容标准 OpenAI SDK,支持文本、视频、视觉和 TTS。

不用迁移 SDK,也不用更换客户端。在现有配置中修改一个 base URL,即可直接使用 Tokenhot 的模型。
查看全部接入文档博客精选
面向 AI 团队的迁移计划、最新定价和模型细节。

为 2026 年 9 月 24 日 Sora API 关停做好准备:归档视频、比较 Kling 与 Seedance,并调整请求、任务处理和切换检查。

比较 2026 年 LLM API 价格,并计算输入、输出、推理、缓存、批处理任务、长上下文、工具和重试的实际成本。

面向开发者的 DeepSeek V4 Pro 0813 指南,涵盖其 1.6T MoE 设计、1M 上下文、官方智能体基准、API 定价和现实的托管需求。