最快的 Claude,接近前沿智能;200k 上下文,支持扩展思考。
模型目录
26 个前沿模型,全部已上线。
按厂商分组:Anthropic、OpenAI(+ GPT Image 2)、Google(Gemini + Nano Banana)、DeepSeek、豆包、GLM、Kimi、MiniMax。一把 key、一个 base URL —— 每个模型官方价与我们的价并排,实时来自网关清单。
Anthropic
7上代旗舰,1M 上下文,支持扩展思考。建议迁移至 Opus 4.7。
Anthropic 最强通用模型,擅长复杂推理与 agentic coding,原生 1M 上下文。
Anthropic 最新旗舰,复杂推理与 agentic coding 进一步增强,原生 1M 上下文。
Anthropic 最新旗舰 Claude Opus 5,复杂推理与 agentic coding 全面领先,原生 1M 上下文。
速度与智能的最佳平衡;1M 上下文,支持扩展/自适应思考。
速度与智能的最佳平衡,adaptive thinking 默认开启,原生 1M 上下文。
OpenAI
8OpenAI 更经济的编码与专业工作模型,1M 上下文。
OpenAI 最强 mini 模型,适合 coding、computer use、subagents,400k 上下文。
OpenAI 旗舰编码与专业工作模型,reasoning effort 可调,1M 上下文。
GPT-5.6 官方别名,固定路由到旗舰档 Sol。
OpenAI 成本敏感高吞吐档(月档),适合抽取/分类/总结类任务,1.05M 上下文。
OpenAI 旗舰前沿模型(日档),复杂编码与长程 agentic 任务,reasoning effort 支持到 max,1.05M 上下文。
OpenAI 智能与成本均衡档(地档),官方称性能与 GPT-5.5 相当但更便宜,1.05M 上下文。
OpenAI 原生图像生成与编辑(/v1/images generations + edits),支持任意分辨率。
低延迟、成本经济的多模态模型,适合翻译、转录、文档处理等高频轻量任务。
Google 最智能模型,持续前沿性能,擅长 agentic 与代码任务。
永远指向最新一代 Gemini Flash;当前等同 gemini-3.5-flash。
永远指向最新一代 Gemini Flash-Lite;当前等同 gemini-3.1-flash-lite。
Google 旗舰 thinking 模型,擅长复杂代码、数学、STEM 推理;1M 上下文。
DeepSeek
2DeepSeek 更快捷、经济的 API 服务;官方通道已切到视觉 SKU,支持图片理解;默认开启深度思考,支持手动关闭。
DeepSeek V4 Pro,Agent 能力显著增强,具备丰富世界知识;默认开启深度思考,支持手动关闭。
智谱 GLM
1智谱 GLM-5 系列首个原生多模态模型,320B 总参/18B 激活,支持图片/视频/文件输入与 1M 上下文。
月之暗面 Kimi
1Kimi 旗舰多模态模型(文本/图片/视频输入),1M 上下文,常驻推理并可经 reasoning_effort 调节力度;Kimi Code 默认 high。
更多
2xAI 智能编码模型,面向 agentic 软件与工程工作流;500k 上下文,可调 reasoning_effort(默认 high)。
xAI 旗舰模型,面向编码、长程 agent 与知识工作;500k 上下文,可调 reasoning_effort(默认 high,含 xhigh)。
缺哪个模型?给 sales@bytespike.ai 发邮件 —— 多数新模型当周即可接入网关。