Skip to main content
API易 支持 400+ 主流 AI 模型,本页面提供详细的模型信息、定价和使用说明。
企业级专业稳定的AI大模型API中转站
本站均为官方源头转发,价格八折(叠加充值加赠和汇率优势),聚合各种优秀大模型。不限速,不惧封号,按量计费,长期可靠服务。

🔥 当前推荐模型

以下为当前稳定供给的热门模型,完整模型列表和实时价格请访问 API易控制台定价页面,也可查看站内 模型价格总览
模型升级建议:我们推荐优先使用最新模型以获得最佳性能,但请注意:
  1. 上线初期可能不稳定:新模型刚发布时,原厂商算力可能不足,导致响应慢、超时或偶发错误,通常数天至数周后趋于稳定
  2. 注意参数兼容性:新模型可能新增或变更参数(如 max_completion_tokens 替代 max_tokens),升级前请检查 API 参数是否兼容老模型
  3. 务必先测试再上线:在将新模型用于生产环境前,务必在测试环境充分验证,确保输出质量和接口兼容性符合预期
表格中上下文一栏标注为「—」的,表示厂商暂未公布明确数值,实际以控制台与官方文档为准。价格均为每 100 万 tokens 挂牌价,可叠加充值加赠优惠。

模型分类

🤖 OpenAI 系列

🆕 最新模型

GPT-5.6 双分组供给:默认官转分组(default / svip)与官网同价,充值最多赠 20%(约 83 折);CodexReverse 分组默认 0.7 折扣,适合成本敏感的批量任务。存量 GPT-5.5 代码只需替换 model 字段即可迁移。详见 GPT-5.6 系列上线说明
GPT Pro 系列(如 gpt-5.5-progpt-5.4-pro)使用须知
  1. 仅支持 /v1/responses 端点:不能走 /v1/chat/completions,调用前请确认 SDK / 代码已切换到 Responses API
  2. 价格高昂:单次调用可能消耗数美金,且仅对 SVIP 分组开放,避免 Default 分组误用
  3. 非专业需求不建议使用:日常任务用 GPT-5.6 Sol / Terra 即可,Pro 仅适合对推理深度有极致要求的科研、顶级任务

✅ 稳定/经典系列

GPT-5 及以上系列使用注意事项
  1. 温度参数 temperature 必须设置为 1(只支持 1)
  2. 使用 max_completion_tokens 替代 max_tokens
  3. 不要传递 top_p 参数
图像和视频生成模型已移至专属页面,请访问 图像与视频生成模型 查看完整列表和定价。

🎭 Claude 系列 (Anthropic)

🆕 最新模型

Fable 5 / Mythos 5 的 30 天数据保留合规:因模型能力先进,Bedrock 与 Anthropic 对高风险滥用执行额外检查,这两款模型的输入与输出将保留 30 天用于严重滥用检测,默认仅自动化安全系统访问,人工审查仅在系统标记潜在危害时发生。保留发生在 AWS / Anthropic 官方侧,API易 为纯透明代理、自身不保留数据;其他 Claude 模型不受影响。详见 Fable 5 上线说明

✅ 稳定/经典系列

最新推荐:Claude Opus 5 智能逼近 Fable 5,但价格只有一半($5/$25,与 Opus 4.8 持平),属于”无痛升级”。Sonnet 5 官方称”迄今最具 Agentic 能力的 Sonnet”,性能逼近 Opus 4.8 而更快更省。稳定首选:Opus 4.7 / Sonnet 4.6 经过充分验证,适合已上线的生产工作流;Haiku 4.5 速度快 2 倍、性价比高。

🌟 Google Gemini 系列

🆕 最新模型

注意:Gemini 3 Pro Preview 已于 2026 年 3 月 9 日停止服务,请迁移至 Gemini 3.1 Pro Preview 或 Gemini 3.6 Flash。

✅ 稳定/经典系列

最新推荐:Gemini 3.6 Flash 与 3.5 Flash-Lite 已完成 Gemini 原生格式 + OpenAI 兼容格式各 30+ 用例的双端点实测,原生工具全部放通,接入前建议先看 3.6 Flash 概览3.5 Flash-Lite 概览稳定首选:Gemini 2.5 Pro(2M 超长上下文)和 Gemini 2.5 Flash 适合已定型的生产环境。

🚀 xAI Grok 系列

🆕 最新模型

✅ 稳定/经典系列

Grok 4.5 的 token 效率优势:SWE Bench Pro 上平均输出仅 15,954 tokens,约为 Opus 4.8 (max) 的 1/4.2,任务步数减半,同任务实际花费显著更低。注意超过 200K tokens 的高上下文请求按官方更高费率计费。

🔍 DeepSeek 系列

🐘 国产模型系列

智谱 AI (GLM)

🆕 最新:GLM-5.2 | ✅ 稳定/经典:GLM-5.1、GLM-5、GLM-4.6
GLM-5.2 特性
  • 上下文由 GLM-5.1 的 200K 跃升至 1M tokens,可一次载入项目级代码与多份长文档
  • 744B MoE,Terminal-Bench 2.1 81.0 / SWE-bench Pro 62.1,长程编程基准开源领先
  • 经阿里云官方授权直连,价格对齐官网(按 1:7 固定汇率折算),叠加充值活动约官网 85 折
  • 长任务建议把 timeout 调到 600 秒以上,详见 GLM-5.2 上线说明

阿里通义千问 (Qwen)

🆕 最新:Qwen3.7-Max | ✅ 稳定/经典:Qwen3.6 系列、Qwen Max / Plus / Turbo

Moonshot Kimi 系列

🆕 最新:Kimi K3 | ✅ 稳定/经典:Kimi K2.6、K2.5、K2
Kimi K3 使用要点
  • 精确 1,048,576 tokens 上下文,全区间统一计价,长代码库 / 长文档可整体塞入,不担心跨档涨价
  • 最大输出默认 131,072、最高可调至 1,048,576 tokens;思考模式常开满档,请预留输出预算
  • 自动上下文缓存,命中部分输入按 $0.30/1M 计费(未命中价的 1/10),多轮对话收益显著

字节跳动 Seed 系列

🆕 最新:Seed 2.1 Turbo | ✅ 稳定/经典:Seed 2.0 Pro / Lite / Mini
Seed 2.1 Turbo 默认开启深度思考:不传任何参数时,一句话的简单问题也会先输出数百 tokens 的思考内容(实测一句话自我介绍消耗 444 输出 tokens,其中思考 409),且思考内容按输出 tokens 正常计费。高频短问答请把 thinking: {"type": "disabled"} 作为基线配置。详见 接入文档

🌐 MiniMax 系列

🆕 最新:MiniMax-M3 | ✅ 稳定/经典:MiniMax-M2.7、M2.5
MiniMax-M3 计费说明
  • 采用阶梯计费,0-512K 区间 $0.30 输入 / $1.20 输出(每 1M tokens),超出部分按更高档单价计费
  • 注意模型名大小写:MiniMax-M3(同系列 MiniMax-M2.7-highspeed 等亦区分大小写)
  • 做百万级长上下文任务前请预估好成本

💰 定价说明

计费方式

  • 按量计费:根据实际使用的 Token 数量计费
  • 无最低消费:充多少用多少
  • 余额有效期:自充值之日起 365 天内有效,再次充值自动重置(详见充值活动说明
  • 实时扣费:每次调用后立即从余额扣除费用

价格优势

  • 官方源头转发,价格略有优势
  • 批量使用可联系客服获取更优惠价格
  • 新用户注册后账号自带 $0.05 试用额度,可直接跑通接入验证

查看实时价格

访问 API易控制台定价页面 查看所有模型的最新价格,或查看站内 模型价格总览

🛠️ 使用建议

模型选择指南

编程开发
  • 顶级性能:Claude Opus 5(智能逼近 Fable 5、价格一半)、GPT-5.6 Sol(Terminal-Bench 2.1 88.8%)、Claude Sonnet 5(SWE-bench 85.2%)、Kimi K3
  • 高性价比:GPT-5.6 Terra(GPT-5.5 级性能价格减半)、Gemini 3.6 Flash、GLM-5.2、MiniMax-M3、DeepSeek V4 Flash
  • 备选:Grok 4.5、Qwen3.7-Max、Kimi K2.6、Gemini 3.5 Flash
文本创作
  • 首选:GPT-5.6 Sol / Terra、Claude Opus 5、Claude Sonnet 5、Gemini 3.6 Flash
  • 备选:chat-latest、Claude Sonnet 4.6、GLM-5.2、GPT-4.1
快速响应
  • 首选:Gemini 3.5 Flash-Lite(默认零思考、约 2 秒)、Claude Haiku 4.5(速度快 2 倍)、GPT-5.6 Luna
  • 备选:Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Seed 2.1 Turbo(需显式关闭思考)
长文本处理
  • 超长上下文:Gemini 2.5 Pro(2M)、Kimi K3(1M 全区间统一计价)、MiniMax-M3(1M)、GLM-5.2(1M)、Claude Opus 5(1M)
  • 注意:部分模型超过一定长度会按更高档阶梯计费(如 Grok 4.5 超 200K、MiniMax-M3 超 512K),长任务前请预估成本
图像生成
  • 最新推荐:gpt-image-2(原生 4K、size/quality 精确控制)、Nano Banana Pro(4K 高清,最佳文本渲染)
  • 高性价比:Nano Banana 2($0.055/张,按量低至 $0.025)、Nano Banana Lite(约 4 秒出图,$0.025/张)
  • 专业设计:Seedream 5.0 Pro($0.12/次,交互式编辑 + 最多 10 张参考图)、Seedream 5.0 Lite($0.035/张)
  • 最便宜:gpt-image-2-all(官逆,$0.03/张)
视频生成
  • 官转首选:VEO 3.1 Official(按次 $0.3 / $1.2,4/6/8 秒,原生同步音轨)
  • 国产主力:Seedance 2.0 系列(标准 / fast / mini 三档)、Wan2.7、HappyHorse 1.1
  • 注意:Sora 2 相关通道已下线,请改用上述通道,详见 图像与视频生成模型
联网搜索
  • 原生联网:Grok 4 All、Grok 3 All(无需工具调用)
  • 搜索 grounding:Gemini 3.6 Flash / 3.5 Flash-Lite(原生工具已放通)

成本优化建议

  1. 分级使用:简单任务用便宜模型,复杂任务用高级模型
  2. 测试优化:先用小模型测试,确定需求后再用大模型
  3. 批量处理:大量相似任务可以选择 Luna / Lite / Mini 档位
  4. 缓存复用:善用各家的上下文缓存(Kimi K3、Seed 2.1 Turbo、Claude 系列命中后输入价可低至 1/10)
  5. 关闭不必要的思考:部分模型默认开启深度思考(如 Seed 2.1 Turbo、Gemini 3.6 Flash),高频短问答显式关闭可同时省钱提速

🔗 相关资源

模型列表持续更新中,我们会及时添加最新发布的优秀模型。最新上新动态请关注 网站公告。如需使用特定模型或有批量需求,请联系客服。