当下模型推荐
verahub-cn 支持 200+ 主流 AI 模型,本页面提供详细的模型信息、定价和使用说明。企业级专业稳定的 AI 大模型 API 中转站,聚合各种优秀大模型。不限速,不过期,按量计费,长期可靠服务。
🔥 当前推荐模型
以下为当前稳定供给的热门模型,完整模型列表和实时价格请访问 verahub-cn 控制台。模型分类
🤖 OpenAI 系列
GPT 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| GPT 5.5 ⭐ | gpt-5.5 | 1M | OpenAI 2026 旗舰完整版,复杂工具调用、专业代码开发、超长上下文与智能体自动化能力全面强化(Codex 版 400K) | 对话、思考、代码能力、文案生成 |
| GPT 5.4 | gpt-5.4 | 1M | 首个融合前沿编码能力的主线推理模型,原生支持计算机使用与复杂 agent 工作流 | 复杂推理、编程、自动化代理 |
| GPT 5.3 | gpt-5.3 | 400K | 强化代码与推理框架,为工程场景优化的主线模型 | 对话、代码能力、复杂任务 |
| GPT 5.2 ⭐ | gpt-5.2 | 400K | 在 GPT-5.1 基础上改进,交互更可靠、灵活和用户友好 | 对话、思考、文案生成、代码能力 |
| GPT 5.1 Codex | gpt-5.1-codex | 400K | 增强开发者工具链,强化推理框架,支持上下文感知的代码分析与生成 | 对话、代码能力、文案生成 |
| GPT 5.1 Chat | gpt-5.1-chat | 128K | 首次在聊天场景引入链式思维,更快、更自然、更具上下文感知的对话体验 | 对话、文案生成 |
| GPT 5.1 | gpt-5.1 | 400K | 重点提升「按需推理」能力,自适应推理 | 对话、思考、文案生成、代码能力 |
| GPT 5.1-mini | gpt-5.1-mini | 128K | 轻量高效,兼顾性能与成本 | 对话、文案生成、轻量代码 |
| GPT 5.1 Codex Mini | gpt-5.1-codex-mini | 128K | 轻量高效,专为资源受限、成本敏感场景打造 | 对话、代码能力、文案生成 |
| GPT-4.1 | gpt-4.1 | 1M | 超长上下文,代码与工具调用能力强化 | 长文档、代码、复杂工具调用 |
| GPT-4.1-mini | gpt-4.1-mini | 1M | GPT-4.1 轻量版,保持长上下文优势 | 长文档、轻量开发 |
| GPT-4o | gpt-4o | 128K | 原生多模态旗舰,速度快、能力强 | 对话、多模态、通用任务 |
图像生成模型
| 模型名称 | 模型ID | 特点 |
|---|---|---|
| GPT-Image-2 ⭐ | gpt-image-2 | OpenAI 新一代图像生成模型,细节画质大幅升级,复杂文本指令精准还原,企业安全合规 |
| GPT-Image-1 | gpt-image-1 | OpenAI 官方图像生成 |
推理模型(Reasoning Models)
| 模型名称 | 模型ID | 特点 | 推荐场景 |
|---|---|---|---|
| o4-mini | o4-mini | 轻量级推理模型 | 编程任务首选 |
| o3-mini ⭐ | o3-mini | 最新推理模型,性价比极高 | 复杂推理、数学、编程 |
| o3 | o3 | 前沿推理模型,复杂科学与数学任务表现突出 | 高难度推理、科研、竞赛数学 |
| o1 | o1 | 首个 o 系列推理模型,强化思维链 | 复杂推理、代码、数学 |
| o1-mini | o1-mini | 轻量快速推理版本 | 日常推理、成本敏感场景 |
🎭 Claude 系列 (Anthropic)
Claude 5 系列(最新)
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Claude Sonnet 5 ⭐ | claude-sonnet-5 | 1M | Anthropic 均衡旗舰迭代版本,代码、文档分析、逻辑推理全面强化,响应速度与性价比优化 | 对话、思考、文案生成、代码能力 |
| Claude Fable 5 | claude-fable-5 | 1M | Anthropic 创意向全新模型,创意叙事、图文创作、角色扮演能力大幅提升,超长文本流畅输出 | 对话、文案创作、多模态创意 |
Claude 4 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Claude Opus 4.7 ⭐ | claude-opus-4-7 | 1M | Anthropic 旗舰模型迭代升级,推理链路深度优化,成本降低,百万级上下文窗口 | 对话、推理、代码能力、文案能力 |
| Claude Opus 4.6 | claude-opus-4-6 | 1M | Anthropic 最智能的模型,为生产代码、复杂代理和复杂办公任务设定了新标准 | 对话、推理、代码能力、文案能力 |
| Claude Sonnet 4.5 | claude-sonnet-4-5-20250929 | 200K | 代理能力进步,工具处理、内存管理和上下文处理性能增强 | 对话、思考、文案生成、代码能力 |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 | 200K | Anthropic 效率最高的模型,快速且经济高效地提供接近前沿的性能 | 对话、思考、文案生成、代码能力 |
| Claude Opus 4.5 | claude-opus-4-5-20251101 | 200K | Anthropic 最智能的模型,为生产代码、复杂代理和复杂办公任务设定了新标准 | 对话、思考、文案生成、代码能力 |
| Claude Opus 4.1 | claude-opus-4-1-20250805 | 200K | 卓越的推理能力 | 对话、思考、文案生成、代码能力 |
Claude 3 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Claude 3.7 Sonnet ⭐ | claude-3-7-sonnet | 200K | 混合推理模型,扩展思考模式,编码与推理能力突出 | 对话、思考、代码能力 |
| Claude 3.5 Sonnet | claude-3-5-sonnet | 200K | 长文档、编码、指令跟随表现优秀 | 对话、代码、长文档 |
| Claude 3 Opus | claude-3-opus | 200K | Claude 3 代最强模型,复杂任务与高难度推理 | 复杂推理、长文档、创意写作 |
🌟 Google Gemini 系列
Gemini 3.x 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Gemini 3.5 ⭐ | gemini-3.5 | 1M | Google 均衡多模态旗舰模型,图文音视频统一理解,复杂多模态推理、实时数据联动能力升级 | 对话、思考、文案生成、代码能力、多模态 |
| Gemini 3 Flash Preview | gemini-3-flash-preview | 1M | 以显著的速度和价值提供强大的代理能力,适合多轮对话 | 对话、思考、文案生成、代码能力 |
| Gemini 3 Pro Preview | gemini-3-pro-preview | 1M | 强大的智能体和编码模型,最佳的多模态理解能力 | 对话、思考、文案生成、代码能力 |
Gemini 2.x 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Gemini 2.5 Pro ⭐ | gemini-2.5-pro | 1M | 推理、代码与多模态能力均衡的前沿模型 | 对话、思考、代码、多模态 |
| Gemini 2.5 Flash | gemini-2.5-flash | 1M | 高性价比快速版本,适合高频调用 | 对话、快速响应、轻量代码 |
| Gemini 2.0 Flash | gemini-2.0-flash | 1M | 原生多模态,速度快,适合多模态工作流 | 对话、多模态、快速响应 |
图像生成模型
| 模型名称 | 模型ID | 特点 |
|---|---|---|
| Nano Banana Pro ⭐ | nano-banana-pro | Gemini 3 Pro Image,功能多样的图像生成模型,将推理能力引入图像生成 |
🚀 xAI Grok 系列
Grok 4 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Grok-4 ⭐ | grok-4 | 256K | 强大的旗舰模型,在自然语言、数学和推理方面提供无与伦比的性能 | 对话、思考、文案生成、代码能力 |
| Grok-4 Fast Reasoning | grok-4-fast-reasoning | 2M | 高性价比,快速推理版本 | 对话、思考、文案生成、代码能力 |
| Grok 4.1 | grok-4.1 | 256K | 情感智能与创意表现增强,复杂高 stakes 任务更可靠 | 对话、研究、创意写作、复杂分析 |
| Grok 4.1 Fast | grok-4.1-fast | 256K | Grok 4.1 的快速版本,兼顾质量与低延迟 | 对话、快速推理、生产工作流 |
Grok 3/2 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Grok-3 | grok-3 | 128K | 擅长企业级应用,具备金融、医疗、法律和科学领域的专业知识 | 对话、文案生成 |
| Grok-3-mini | grok-3-mini | 128K | Grok-3 轻量版本,成本低、响应快 | 轻量对话、快速响应 |
| Grok-2 | grok-2 | 128K | 上一代旗舰,综合能力扎实 | 对话、通用任务 |
🐘 国产模型系列
🔍 DeepSeek 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| DeepSeek V4-Pro | deepseek-v4-pro | 1M | V4 专业版,1.6T 总参数 / 49B 激活参数,MoE 架构 | 复杂推理、代码、长上下文 |
| DeepSeek V4-Flash | deepseek-v4-flash | 1M | V4 轻量高速版,284B 总参数 / 13B 激活参数 | 快速响应、高频调用 |
| DeepSeek V3.2 | deepseek-v3.2 | 128K | V3 系列升级版本,综合能力与推理效率提升 | 对话、思考、代码能力 |
| DeepSeek V3.1 250821 | deepseek-v3.1-250821 | 128K | 深度求索全新混合推理模型,支持思考与非思考 2 种推理模式,较 DeepSeek-R1 思考效率更高 | 对话、思考、文案生成、代码能力 |
| DeepSeek V3 | deepseek-v3 | 128K | 综合能力强,性价比高 | 通用场景 |
| DeepSeek V2.5 | deepseek-v2.5 | 128K | 合并 Chat 与 Coder 能力的综合模型,性价比出色 | 对话、代码、通用任务 |
| DeepSeek Coder V2 | deepseek-coder-v2 | 128K | 专门优化的代码模型 | 代码生成、编程辅助 |
| DeepSeek R1 | deepseek-r1 | 64K | 推理模型 | 数学、推理 |
智谱 AI (GLM)
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| GLM 5.2 ⭐ | glm-5.2 | 1M | 智谱 AI 新一代基座模型,逻辑推理、多轮对话、行业知识库适配全面升级,本地部署友好 | 对话、思考、文案生成、代码能力 |
| GLM 5.1 | glm-5.1 | 1M | 智谱上一代旗舰,综合能力强,性价比高 | 对话、文案生成、代码能力 |
| glm-5 | glm-5 | 200K | 智谱旗舰对话模型,200K 上下文 | 对话、文案生成、代码能力 |
| glm-4.7 | glm-4.7 | 200K | 智谱旗舰,具备更强的编程能力与更稳定的多步骤推理/执行能力,总参数 355B | 对话、思考、长程任务规划、编码、工具协同 |
| glm-4.5 | glm-4.5 | 128K | 智谱 2025 旗舰,推理、编码与智能体能力均衡 | 对话、思考、代码能力 |
| GLM-4V | glm-4v | 8K | 智谱多模态视觉模型 | 图像理解、多模态任务 |
豆包 (Doubao) Seed 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Doubao Seed 2.0 Pro ⭐ | doubao-seed-2-0-pro | 256K | 字节火山方舟 Seed 2.0 旗舰,多模态理解、推理与代码能力全面升级 | 对话、思考、代码、多模态 |
| Doubao Seed 2.0 Lite | doubao-seed-2-0-lite | 256K | Seed 2.0 轻量版,高性价比 | 对话、轻量任务 |
| Doubao Seed 2.0 Mini | doubao-seed-2-0-mini | 256K | Seed 2.0 极小版,成本极低 | 简单对话、高频调用 |
| 豆包 Seed 1.8 | doubao-seed-1-8-251228 | 见控制台 | 豆包对话模型 | 对话、文案生成 |
| 豆包 Seed 1.6 | doubao-seed-1-6-251015 | 见控制台 | 豆包上一代对话模型 | 对话、文案生成 |
阿里通义千问 (Qwen)
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Qwen 3.7plus ⭐ | qwen-3.7plus | 1M | 阿里通义千问新一代增强大模型,中文理解深度优化,长文档解析、代码工程能力升级,多模态兼容 | 对话、思考、文案生成、代码能力 |
| Qwen3 | qwen3 | 256K | 通义千问第三代 MoE 旗舰,双模思考,256K 上下文 | 对话、思考、代码能力 |
| Qwen3-Coder | qwen3-coder | 256K | 面向编程场景优化的 Qwen3 版本 | 代码生成、编程辅助 |
| Qwen2.5 | qwen2.5 | 128K | 性能与资源均衡,18T tokens 训练 | 对话、文案生成、通用任务 |
| Qwen2.5-Coder | qwen2.5-coder | 128K | 代码专用模型 | 代码生成、编程辅助 |
| Qwen Image Plus | qwen-image-plus | 32K | 通义千问系列图像生成模型,参数规模 200 亿,卓越的文本渲染能力 | 文生图、图片生成 |
| Qwen3 Coder Plus | qwen3-coder-plus | 1M | 基于 Qwen3 的代码生成模型,强大的 Coding Agent 能力,擅长工具调用和环境交互 | 对话、思考、代码能力、文案生成 |
Moonshot Kimi 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| Kimi 2.7 ⭐ | kimi-2.7 | 256K | 月之暗面全新迭代版本,超大无损上下文窗口,海量文件批量解析速度提升,网页 / 文档多源数据汇总能力优化 | 对话、思考、文案生成、长文本处理 |
| Kimi K2.6 | kimi-k2-6 | 262K | K2 系列升级版本,在 SWE-Bench Pro 等编程基准上表现突出 | 对话、代码、长上下文 |
| kimi-k2.5 | kimi-k2.5 | 256K | 月之暗面迄今发布最全能的模型,原生多模态架构设计,支持视觉与文本输入、思考与非思考模式 | 对话、思考 |
| Kimi K2 250905 | kimi-k2-250905 | 256K | 具备超强代码和 Agent 能力的 MoE 架构基础模型,总参数 1T,激活参数 32B | 对话、思考、文案生成、代码能力 |
| Kimi K2 | kimi-k2 | 128K | 开源 MoE 架构首秀,1T 参数 / 32B 激活,擅长智能体与编码任务 | 对话、代码、长文本 |
🎬 视频生成模型
| 模型名称 | 模型ID | 特点 | 推荐场景 |
|---|---|---|---|
| SeeDance 2.0 ⭐ | seedance-2-0 | 字节火山方舟视频生成模型,高清影视级画面、精准动作控制、极速生成双模式,工作流无缝接入 | 短视频、广告、影视创作 |
| SeeDance 2.0-Fast | seedance-2-0-fast | SeeDance 2.0 极速版本,主打极速出片,成本可控 | 快速出片、批量生成 |
| Vidu | vidu | 专业级视频生成,文本/图像驱动高质量视频、长视频支持,动态细节与光影表现优秀 | 专业创作、中长视频 |
| 可灵系列 | kling | 一站式 AIGC 创作模型,文生图/视频/数字人全场景覆盖 | 短视频、数字人、营销创意 |
| Sora 2 | sora-2 | OpenAI 革命性视频生成模型,音视频同步、无水印输出、商用级别质量 | 影视、广告、创意短片 |
🎵 音频与语音模型
| 模型名称 | 模型ID | 特点 | 推荐场景 |
|---|---|---|---|
| GPT-4o Audio ⭐ | gpt-4o-audio | OpenAI 原生音频对话模型,支持语音输入输出与实时交互 | 语音对话、实时客服 |
| Gemini 2.0 Live API | gemini-2-0-live | Google 实时多模态语音交互,低延迟自然对话 | 实时对话、直播互动 |
| 豆包语音合成 | doubao-tts | 字节火山方舟 TTS,音色自然、支持多情感多语言 | 有声书、客服播报、视频配音 |
| Qwen-Audio | qwen-audio | 通义千问音频理解模型,支持语音转写与音频内容分析 | 语音转文字、音频分析 |
📊 嵌入模型(Embeddings)
| 模型名称 | 模型ID | 向量维度 | 特点 | 推荐场景 |
|---|---|---|---|---|
| text-embedding-3-large ⭐ | text-embedding-3-large | 3072 | OpenAI 高性能嵌入模型,语义表示能力强 | 语义搜索、RAG、知识库 |
| text-embedding-3-small | text-embedding-3-small | 1536 | OpenAI 高性价比嵌入模型 | 大规模检索、低成本场景 |
| gte-Qwen2 | gte-qwen2 | 768 | 阿里通义千问嵌入模型,中文语义检索效果好 | 中文语义搜索、RAG |
| BGE-M3 | bge-m3 | 1024 | 智源 BGE 多语言嵌入模型,支持多语言与长文本 | 多语言检索、跨语言搜索 |
💰 定价说明
计费方式
- 按量计费:根据实际使用的 Token 数量计费(图像/视频/音频按次或按量计费,详见控制台)
- 无最低消费:充多少用多少,余额永不过期
- 实时扣费:每次调用后立即从余额扣除费用
价格优势
- 官方源头转发,价格略有优势
- 批量使用可联系客服获取更优惠价格
🛠️ 使用建议
模型选择指南
- 编程开发
- 文本创作
- 快速响应
- 图像生成
- 长文本处理
- 多模态理解
- 智能体 / 自动化
- 数学 / 推理
- 中文场景
- 视频生成
- 语音交互 / TTS
- 语义检索 / RAG
- 顶级性能:Claude Sonnet 5、Claude Opus 4.7、GPT 5.5、GPT 5.4、Kimi K2.6
- 高性价比:Deepseek V4、DeepSeek V4-Flash、Claude Haiku 4.5、Qwen3-Coder、GLM 5.2、Grok-4 Fast Reasoning
- 备选:o3-mini、o4-mini、Gemini 3.5、Gemini 2.5 Pro、Qwen 3.7plus、Kimi 2.7、doubao-seed-2-0-code
- 首选:Claude Sonnet 5、Claude Fable 5、GPT 5.5、Claude Opus 4.7、Kimi 2.7
- 高性价比:GPT 5.2、GLM 5.2、Qwen 3.7plus、Gemini 2.5 Pro
- 备选:Gemini 3.5、Claude 3.7 Sonnet、glm-4.7、doubao-seed-2-0-lite
- 首选:Claude Haiku 4.5、Gemini 3 Flash Preview、Gemini 2.5 Flash、Grok 4.1 Fast、Grok-4 Fast Reasoning
- 高性价比:GLM 5.2、glm-4.5、GPT 5.1-mini、GPT 5.1 Codex Mini、doubao-seed-2-0-mini
- 备选:o1-mini、Grok-3-mini、Qwen2.5
- 推荐:GPT-Image-2、Nano Banana Pro(Gemini 3 Pro Image)、Qwen Image Plus、GPT-Image-1
- 超长上下文:Gemini 3.5(1M)、Gemini 2.5 Pro(1M)、Claude Opus 4.7(1M)、Claude Sonnet 5(1M)、GPT 5.5(1M)、GPT-4.1(1M)、Deepseek V4(1M)、GLM 5.2(1M)、Qwen 3.7plus(1M)、Kimi 2.7(256K)
- 编程 + 长文本:Claude Sonnet 5、Claude Opus 4.7、Kimi K2.6、Kimi 2.7
- 首选:Gemini 3.5、Claude Sonnet 5、GPT-4o、Kimi-k2.5
- 高性价比:Gemini 2.5 Flash、GLM-4V、Doubao Seed 2.0 Pro
- 备选:Claude 3.7 Sonnet、Qwen3-VL
- 首选:Claude Sonnet 5、GPT 5.5、GPT 5.4、Gemini 3.5
- 高性价比:Deepseek V4、Grok-4、GLM 5.2、Doubao Seed 2.0 Pro
- 备选:Claude Opus 4.7、Kimi K2.6、Qwen 3.7plus
- 首选:o3、o4-mini、GPT 5.4、Deepseek V4-Pro
- 高性价比:o3-mini、DeepSeek V3.2、Qwen3
- 备选:GPT 5.5、Claude Sonnet 5、Gemini 2.5 Pro
- 首选:Qwen 3.7plus、Kimi 2.7、GLM 5.2
- 高性价比:Qwen3、glm-4.7、Doubao Seed 2.0 Pro、Doubao Seed 1.8
- 备选:Qwen2.5、Kimi K2.6、doubao-seed-2-0-lite
- 首选:SeeDance 2.0、Vidu、Sora 2
- 高性价比:SeeDance 2.0-Fast、可灵系列
- 备选:doubao-seedance-2-0-lite
- 首选:GPT-4o Audio、Gemini 2.0 Live API
- 高性价比:豆包语音合成、Qwen-Audio
- 备选:其他平台 TTS 模型
- 首选:text-embedding-3-large
- 高性价比:text-embedding-3-small、gte-Qwen2
- 备选:BGE-M3
成本优化建议
- 分级使用:简单任务用便宜模型,复杂任务用高级模型
- 测试优化:先用小模型测试,确定需求后再用大模型
- 批量处理:大量相似任务可以选择 Mini 版本
- 缓存复用:对重复查询结果进行缓存
🔗 相关资源
API 文档
详细接口说明
快速开始
集成指南
模型列表持续更新中,我们会及时添加最新发布的优秀模型。如需使用特定模型或有批量需求,请联系客服。
