全球版
面向国际化或以英文负载为主的场景。
Claude · GPT-5 · Gemini · DeepSeek V4
- Claude Sonnet 4.6 / Opus 4.7 + GPT-5.5 作 agent 主脑
- GPT-5.4 mini · Gemini 3.5 Flash · Claude Haiku 4.5 跑廉价路由
- GPT-Image 2 · Nano Banana Pro / Nano Banana 2 出图;Veo 3.1 出视频
一个 API,调用所有前沿大模型。一把 key 打通 Anthropic / OpenAI / Gemini 兼容协议,透明美元计价 + 真实折扣(Claude 低至 1.8折),缓存与用量全程可见。
curl https://llm.bytespike.ai/v1/chat/completions \
-H "Authorization: Bearer $BS_KEY" \
-d '{"model":"claude-sonnet-4-6","messages":[{"role":"user","content":"Hi"}]}'一个网关 · 26 个前沿模型 · 8 家厂商
查看全部 →14 个端点,一把 key
图像 · 视频 · 文本 · 账户 · 异步任务 —— 完整目录。每张卡片直达接口参考,自带集成示例。
1024² · text-to-image · img-to-img
OpenAI 图像生成模型。prompt 保真度最高、字体处理强、写实输出突出。按 token 计费,相对官方 8 折。
Gemini 3 Pro Image · editorial-grade
Gemini 3 Pro 生图(Nano Banana Pro)。编辑级画质,prompt 跟随度高,支持图生图编辑。
Gemini 3.1 Flash Image · volume
Gemini 3.1 Flash 生图(Nano Banana 2)。快速、便宜、适合批量的文生图。
按调用计费。失败时释放预扣余额。提交时即返回 estimated_credits,用户确认前可展示成本。
为什么选 ByteSpike
每个模型都把官方价与我们的价并排 —— Claude 低至 1.8折,国产模型(DeepSeek · 豆包 · GLM · Kimi)统一 半价。调用失败不计费。
26 个前沿模型,覆盖 8 家厂商 —— Anthropic · OpenAI · Google · DeepSeek · 豆包 · GLM · Kimi · MiniMax —— 每个值得用的模型,统一在一个 Anthropic 形态 API 后面。
换 base_url、粘 key、上线。OpenAI Chat Completions 与 Anthropic Messages 都直接 drop-in。
洛杉矶 Lisahost 主干 + Cloudflare 边缘。网关中位开销低于 80ms。tool_use / cache_control / thinking 全部透传。
注册即送余额,无需信用卡。estimated_credits 提交时返回,让你在用户确认前展示成本。
私有部署 SKU、SSO / OIDC、审计日志、组织级钱包、按 key 配额 / 速率限制 / IP 白名单。准备好时联系销售。
精选起跳点
ByteSpike 默认搭载两套精选模型包,第一天不用从 30 个 SKU 里挑。一键应用全球版或中国版;摸清哪些模型挣到了它的位置后再按团队微调。
面向国际化或以英文负载为主的场景。
Claude · GPT-5 · Gemini · DeepSeek V4
面向 PRC 合规或 PII 敏感工作负载。
DeepSeek · Doubao · GLM · Kimi · MiniMax
自定义模板在预设之上叠加 — fork 全球版、换 DeepSeek V4 Flash、删掉出图、存为团队 stack。成员级 override 跟团队允许清单在后端取交集。
组织管理员怎么用预设模型目录
26 个模型,覆盖对话、图像、视频 —— Anthropic、OpenAI、Google、DeepSeek、豆包、GLM、Kimi、MiniMax,统一在一个 Anthropic 形态 API 后面。
Claude Haiku 4.5
1.8折最快的 Claude,接近前沿智能;200k 上下文,支持扩展思考。
Claude Opus 4.6
1.8折上代旗舰,1M 上下文,支持扩展思考。建议迁移至 Opus 4.7。
Claude Opus 4.7
1.8折Anthropic 最强通用模型,擅长复杂推理与 agentic coding,原生 1M 上下文。
Claude Opus 4.8
1.8折Anthropic 最新旗舰,复杂推理与 agentic coding 进一步增强,原生 1M 上下文。
Claude Opus 5
1.8折Anthropic 最新旗舰 Claude Opus 5,复杂推理与 agentic coding 全面领先,原生 1M 上下文。
Claude Sonnet 4.6
1.8折速度与智能的最佳平衡;1M 上下文,支持扩展/自适应思考。
Claude Sonnet 5
1.8折速度与智能的最佳平衡,adaptive thinking 默认开启,原生 1M 上下文。
GPT-5.4
8折OpenAI 更经济的编码与专业工作模型,1M 上下文。
GPT-5.4 mini
8折OpenAI 最强 mini 模型,适合 coding、computer use、subagents,400k 上下文。
GPT-5.5
8折OpenAI 旗舰编码与专业工作模型,reasoning effort 可调,1M 上下文。
GPT-5.6 (Sol)
8折GPT-5.6 官方别名,固定路由到旗舰档 Sol。
GPT-5.6 Luna
8折OpenAI 成本敏感高吞吐档(月档),适合抽取/分类/总结类任务,1.05M 上下文。
GPT-5.6 Sol
8折OpenAI 旗舰前沿模型(日档),复杂编码与长程 agentic 任务,reasoning effort 支持到 max,1.05M 上下文。
GPT-5.6 Terra
8折OpenAI 智能与成本均衡档(地档),官方称性能与 GPT-5.5 相当但更便宜,1.05M 上下文。
GPT Image 2
8折OpenAI 原生图像生成与编辑(/v1/images generations + edits),支持任意分辨率。
Gemini 3.1 Flash-Lite
低延迟、成本经济的多模态模型,适合翻译、转录、文档处理等高频轻量任务。
Gemini 3.5 Flash
Google 最智能模型,持续前沿性能,擅长 agentic 与代码任务。
Gemini Flash (latest)
永远指向最新一代 Gemini Flash;当前等同 gemini-3.5-flash。
Gemini Flash-Lite (latest)
永远指向最新一代 Gemini Flash-Lite;当前等同 gemini-3.1-flash-lite。
Gemini Pro (latest)
Google 旗舰 thinking 模型,擅长复杂代码、数学、STEM 推理;1M 上下文。
DeepSeek V4 Flash
DeepSeek 更快捷、经济的 API 服务;官方通道已切到视觉 SKU,支持图片理解;默认开启深度思考,支持手动关闭。
DeepSeek V4 Pro
DeepSeek V4 Pro,Agent 能力显著增强,具备丰富世界知识;默认开启深度思考,支持手动关闭。
GLM 5.3 Flash
智谱 GLM-5 系列首个原生多模态模型,320B 总参/18B 激活,支持图片/视频/文件输入与 1M 上下文。
Kimi K3
Kimi 旗舰多模态模型(文本/图片/视频输入),1M 上下文,常驻推理并可经 reasoning_effort 调节力度;Kimi Code 默认 high。
Grok 4.5
xAI 智能编码模型,面向 agentic 软件与工程工作流;500k 上下文,可调 reasoning_effort(默认 high)。
Grok 4.6
xAI 旗舰模型,面向编码、长程 agent 与知识工作;500k 上下文,可调 reasoning_effort(默认 high,含 xhigh)。
早期客户计划
ByteSpike 刚开放公开预览。前 50 个完成接入的团队可直接对接工程团队、价格变动后追溯调整、上线后获得公开 logo 展位(确认引用授权后)。
hello@bytespike.ai · 1 个工作日内回复
常见问题