我想要AI

一个大 KEY · 调用所有大模型

89

可用模型

11

模型厂商

99.9%

服务可用性

模型广场

共 89 个模型
可用
GOOGLE

Gemini 3.8 Flash

Google 最新推出的 Flash 级工具,适用于编码、智能体工作流程、知识工作和多模态推理,据报道其准确率高于 Gemini 3.7 Flash,并拥有 100 万个标记的上下文窗口。

文本生成
上下文 1M · 输出 128K7.02 / 出 35.1 元/百万tokens
查看详情
可用
OPENAI

GPT‑6 Astra

GPT-6 Astra 专为最复杂的端到端工作而打造。它可用于复杂的推理、编码、计算机操作、研究和文档创建。

文本生成
上下文 1M · 输出 128K84.24 / 出 421.2 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Fable 5.1

Claude Fable 5.1 在 Claude Fable 5 的基础上进行了扩展,输入输出成本保持不变,缓存读取成本仅为四分之一,并增强了长时间运行的智能体编码、多步骤研究以及文档、电子表格和幻灯片处理能力。

文本生成
上下文 1M · 输出 128K93.6 / 出 468 元/百万tokens
查看详情
可用
智谱AI

GLM-5.3-Flash

GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,以极致低成本架构实现超越 GLM-5.2 的更强智能

文本生成
上下文 1M · 输出 128K1.404 / 出 4.68 元/百万tokens
查看详情
可用
智谱AI

GLM-5.3

GLM-5.3 是智谱最新旗舰模型,复杂软件工程与 Agent 任务能力全面进阶。它使用与 GLM-5.2 相同的基础模型——所有提升均来自后训练。与 GLM-5.2 相比,它在复杂编程和长程任务方面表现更加出色

文本生成
上下文 1M · 输出 128K11.7 / 出 41.184 元/百万tokens
查看详情
可用
DEEPSEEK

DeepSeek V4 Flash Vision Exp

使用实验性 deepseek-v4-flash-vision-exp 模型执行混合图像和文本任务,例如屏幕截图检查、文档提取、图表分析和视觉代理。

文本生成
上下文 1M · 输出 384K4.1371 / 出 12.3926 元/百万tokens
查看详情
可用
XAI

Grok 4.6

SpaceXAI 的编码、代理任务和知识工作的前沿模型。

文本生成
上下文 500K · 输出 100K18.72 / 出 56.16 元/百万tokens
查看详情
可用
月之暗面

Kimi K3

Kimi K3 是一条面向复杂任务的旗舰推理路由,适合截图还原与交互式前端原型、大型代码仓库、多文档证据综合、长时间运行的智能体,以及确实需要 105 万 Token 工作上下文的知识任务。

文本生成
上下文 1M · 输出 131K28.08 / 出 140.4 元/百万tokens
查看详情
可用
GOOGLE

Gemini 3.6 Flash

Gemini 3.6 Flash 持续提供前沿模型级的智能表现,经过优化,能够以更快的速度和更低的成本处理实际任务。专为智能体时代而设计,擅长代码生成、智能体执行和空间推理。此模型在涉及复杂编码周期和迭代的快速代理循环方面特别有效。

文本生成
上下文 105K · 输出 66K14.04 / 出 70.2 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Opus 5

Opus 5 专为日常使用而设计:它比其他型号工作效率更高。它是Claude Max上的新默认模型,也是Claude Pro上最强的模型。

文本生成
上下文 100K · 输出 256K46.8 / 出 234 元/百万tokens
查看详情
可用
OPENAI

GPT 5.6 Sol

GPT-5.6 Sol是OpenAI GPT-5.6系列中的旗舰型号。它适用于复杂的推理、编码和代理工作流程,并且在命令行和多步骤编码任务以及长期问题解决方面尤其强大。

文本生成
上下文 100K · 输出 256K44.46 / 出 266.76 元/百万tokens
查看详情
可用
OPENAI

GPT 5.6 Terra

GPT-5.6 Terra 是 OpenAI GPT-5.6 系列中的平衡型号,定位于旗舰 Sol 层和经济高效的 Luna 层之间。它适用于需要平衡能力和成本的日常编码、推理和代理任务,以大约 Sol 一半的成本提供强大的性能。

文本生成
上下文 100K · 输出 256K17.784 / 出 106.704 元/百万tokens
查看详情
可用
OPENAI

GPT 5.6 Luna

GPT-5.6 Luna 是 OpenAI GPT-5.6 系列中快速、经济高效的型号。它适用于大容量、延迟敏感的任务,例如聊天、分类和轻量级代理工作流程,为其价格层提供有力的推理。

文本生成
上下文 1M · 输出 256K1.7784 / 出 10.6704 元/百万tokens
查看详情
可用
XAI

Grok 4.5

Grok 4.5 是 SpaceXAI 最智能的模型,在编码、知识工作和 STEM 方面具有前沿性能。

文本生成
上下文 500K · 输出 128K18.72 / 出 56.16 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Sonnet 5

Sonnet 5 是 Anthropic 最强大的 Sonnet 级模型,在编码、代理和专业工作方面具有前沿性能。它支持自适应思维,具有可选择的推理工作级别(低、中、高、最大和超高)、1M 令牌上下文窗口以及文本、图像和文件输入。 Sonnet 5 使用更新的标记器,并包括实时网络保护措施,可阻止某些高风险的双重用途活…

文本生成
上下文 1M · 输出 128K22.464 / 出 112.32 元/百万tokens
查看详情
可用
阿里通义

Qwen3.7 max

Qwen3.7-Max是阿里巴巴Qwen3.7系列的旗舰机型。它支持文本输入和输出,专为以代理为中心的工作负载而设计,在编码、办公和生产力任务以及长期自主执行方面具有独特的优势。与前几代 Qwen 相比,该模型在编码和代理性能方面取得了显着的进步,并支持显式提示缓存以实现高效的重复上下文使用。

文本生成
上下文 1M · 输出 128K16.5176 / 出 49.5529 元/百万tokens
查看详情
可用
阿里通义

Qwen3.7 plus

Qwen3.7-Plus是阿里巴巴Qwen3.7系列中的一款高性价比机型。它支持文本和图像输入以及文本输出,以该系列的文本功能为基础,对其视觉语言能力进行了全面升级,同时保留了编码、工具使用和生产力工作流程的全栈、代理级智能。其显着特征是多模式交互式混合代理功能:它可以感知现实世界场景、读取屏幕并与 GUI 交互、从视…

文本生成
上下文 1M · 输出 128K2.7529 / 出 11.0118 元/百万tokens
查看详情
可用
智谱AI

GLM-5.2

GLM 5.2是Z.ai的大规模推理模型。它支持使用 1M 令牌上下文窗口进行文本输入和输出,适用于长期代理工作流程、项目级软件工程和复杂的多步骤自动化。 支持推理努力 high 和 xhigh; xhigh 映射到最大推理。它特别擅长跨长时间运行的任务进行编码和工具使用,能够在单个任务中维护工程环境并在整个开发工作…

文本生成
上下文 1M · 输出 128K11.0118 / 出 38.5412 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Fable 5

Claude Fable 5 是 Anthropic 的 Mythos 级模型,专为自主知识工作和编码而构建。它支持文本、图像和文件输入以及文本输出,并具有推理支持和 1M 令牌上下文窗口。它适用于以前需要频繁人工签入的长时间运行、复杂和异步任务。 它在端到端工作中尤其强大,否则这些工作需要一个人花费数小时、数天或数…

文本生成
上下文 1M · 输出 128K88.92 / 出 444.6 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Opus 4.8

Claude Opus 4.8 是 Anthropic Opus 系列中功能最强大的通用型号。它支持文本、图像和文件输入以及文本输出,并具有推理支持和 1M 令牌上下文窗口。它适用于高度自主的代理、长期代理工作、知识工作和记忆驱动的任务,在这些任务中,长时间会话的一致性很重要。 它在多步骤推理、复杂编码和端到端项目编…

文本生成
上下文 1M · 输出 128K46.8 / 出 234 元/百万tokens
查看详情
可用
智谱AI

GLM 5V Turbo

GLM-5V-Turbo 是智谱首个多模态 Agent 基座模型,面向视觉编程与复杂任务场景深度优化,支持图像、视频、文本与文件等多模态输入,强化视觉理解、长程规划与动作执行能力。相比通用多模态模型,它更适合融入 Agent 工作流,完成「环境感知 → 任务规划 → 执行落地」的完整闭环,让多模态能力从“能看懂”走向“…

文本生成
上下文 131K · 输出 32K6.8824 / 出 30.2824 元/百万tokens
查看详情
可用
GOOGLE

Gemini 3.5 Flash

Gemini 3.5 Flash 是 Google 的高效多模态模型,以 Flash 级别的成本和速度带来接近 Pro 级别的编码和推理。它针对编码能力和并行代理执行循环进行了高度优化,支持文本、图像、视频、音频和 PDF 输入。 默认为中等思维努力,以获得更快、更具成本效益的响应,并完全支持思维级别(最小、低、中、…

文本生成
上下文 105K · 输出 64K14.04 / 出 84.24 元/百万tokens
查看详情
可用
GOOGLE

Gemini 3.1 Flash Lite Preview

Gemini 3.1 Flash Lite Preview 是 Google 针对大容量用例进行优化的高效模型。它在整体质量上优于 Gemini 2.5 Flash Lite,并在关键功能方面接近 Gemini 2.5 Flash 性能。改进涵盖音频输入/ASR、RAG 片段排名、翻译、数据提取和代码完成。支持完整的思…

文本生成
上下文 1M · 输出 66K2.34 / 出 14.04 元/百万tokens
查看详情
可用
字节豆包

Doubao-Seed-2.0-lite

面向高频企业场景兼顾性能与成本的均衡型模型,综合能力超越上一代Doubao-Seed-1.8。胜任非结构化信息处理、内容创作、搜索推荐、数据分析等生产型工作,支持长上下文、多源信息融合、多步指令执行与高保真结构化输出。在保障稳定效果的同时显著优化成本。

文本生成
上下文 1M · 输出 66K0.8259 / 出 4.9553 元/百万tokens
查看详情
可用
字节豆包

Doubao-Seed-2.0-pro

旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。

文本生成
上下文 1M · 输出 66K4.4047 / 出 22.0235 元/百万tokens
查看详情
可用
OPENAI

GPT-5.5

GPT-5.5是OpenAI专为复杂专业工作负载而设计的前沿模型,建立在GPT-5.4的基础上,具有更强的推理能力、更高的可靠性以及在困难任务上提高的代币效率。它具有 1M+ 令牌上下文窗口(922K 输入,128K 输出),支持文本和图像输入,可在单个系统内实现大规模推理、编码和多模式工作流程。

文本生成
上下文 1M · 输出 128K46.8 / 出 280.8 元/百万tokens
查看详情
可用
DEEPSEEK

DeepSeek V4 Pro

DeepSeek V4 Pro是DeepSeek推出的大规模Mixture-of-Experts模型,总参数为1.6T,激活参数为49B,支持1M-token上下文窗口。它专为高级推理、编码和长期代理工作流程而设计,在知识、数学和软件工程基准方面具有强大的性能。 它采用与 DeepSeek V4 Flash 相同的架…

文本生成
上下文 1M · 输出 384K12.3552 / 出 37.0656 元/百万tokens
查看详情
可用
DEEPSEEK

DeepSeek V4 Flash

DeepSeek V4 Flash 是 DeepSeek 的效率优化混合专家模型,总参数为 284B,激活参数为 13B,支持 1M 代币上下文窗口。它专为快速推理和高吞吐量工作负载而设计,同时保持强大的推理和编码性能。 该模型包括用于高效长上下文处理的混合注意力,并支持可配置的推理模式。它非常适合编码助理、聊天系统…

文本生成
上下文 1M · 输出 384K4.1184 / 出 12.3552 元/百万tokens
查看详情
可用
阿里通义

Qwen3.6 Flash

Qwen3.6原生视觉语言Flash模型基于混合架构构建,将线性注意力机制与稀疏专家混合模型相结合,实现更高的推理效率。与 3 系列相比,这些模型在纯文本和多模式任务方面实现了性能飞跃,提供快速响应时间,同时平衡推理速度和整体性能。

文本生成
上下文 1M · 输出 66K1.6518 / 出 9.9106 元/百万tokens
查看详情
可用
阿里通义

Qwen3.6 Max Preview

Qwen3.6 Max Preview 建立在混合架构之上,将高效的线性注意力与稀疏的专家混合路由相结合,从而实现强大的可扩展性和高性能推理。与3.5系列相比,它在代理编码、前端开发和整体推理方面都有很大的进步,“vibe编码”体验得到显着改善。该模型擅长执行 3D 场景、游戏和存储库级问题解决等复杂任务,在 SWE-…

文本生成
上下文 1M · 输出 66K12.3882 / 出 74.3294 元/百万tokens
查看详情
可用
阿里通义

Qwen3.6 Plus

Qwen 3.6 Plus 建立在混合架构之上,将高效的线性注意力与稀疏的专家混合路由相结合,从而实现强大的可扩展性和高性能推理。与3.5系列相比,它在代理编码、前端开发和整体推理方面都有很大的进步,“vibe编码”体验得到显着改善。该模型擅长执行 3D 场景、游戏和存储库级问题解决等复杂任务,在 SWE-bench…

文本生成
上下文 1M · 输出 66K2.7529 / 出 16.5176 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Opus 4.7

Opus 4.7 是 Anthropic Opus 系列的下一代产品,专为长期运行的异步代理而构建。它以 Opus 4.6 的编码和代理优势为基础,在复杂的多步骤任务上提供更强大的性能,并在扩展工作流程中提供更可靠的代理执行。它对于任务随时间展开的异步代理管道特别有效 - 大型代码库、多阶段调试和端到端项目编排。 除…

文本生成
上下文 1M · 输出 128K46.8 / 出 234 元/百万tokens
查看详情
可用
智谱AI

GLM 5

GLM-5 是 Z.ai 的旗舰开源基础模型,专为复杂系统设计和长期代理工作流程而设计。它专为专家开发人员打造,可在大规模编程任务中提供生产级性能,可与领先的闭源模型相媲美。凭借先进的代理规划、深度后端推理和迭代自我修正,GLM-5 超越了代码生成,进入了全系统构建和自主执行。

文本生成
上下文 131K · 输出 131K5.5059 / 出 24.7765 元/百万tokens
查看详情
可用
智谱AI

GLM 5 Turbo

GLM-5 Turbo 是 Z.ai 的新模型,专为在 OpenClaw 场景等代理驱动环境中实现快速推理和强大性能而设计。它针对涉及长执行链的现实世界代理工作流程进行了深度优化,改进了复杂指令分解、工具使用、计划和持久执行以及扩展任务的整体稳定性。

文本生成
上下文 131K · 输出 131K6.8824 / 出 30.2824 元/百万tokens
查看详情
可用
智谱AI

GLM-5.1

GLM-5.1 在编码能力方面实现了重大飞跃,在处理长期任务方面尤其显着。与之前围绕分钟级交互构建的模型不同,GLM-5.1可以独立连续地处理单个任务超过8小时,在整个过程中自主规划、执行和改进自身,最终交付完整的工程级结果。

文本生成
上下文 131K · 输出 131K8.2588 / 出 33.0353 元/百万tokens
查看详情
可用
OPENAI

GPT-5.4 Nano

GPT-5.4 nano 是 GPT-5.4 系列中最轻量且最具成本效益的变体,针对速度关键和大批量任务进行了优化。它支持文本和图像输入,专为低延迟用例而设计,例如分类、数据提取、排名和子代理执行。 该模型优先考虑响应能力和效率而不是深度推理,使其成为需要大规模快速、可靠输出的管道的理想选择。 GPT-5.4 nan…

文本生成
上下文 400K · 输出 128K1.872 / 出 11.7 元/百万tokens
查看详情
可用
XAI

Grok 4.1 Fast

Grok 4.1 Fast 是 xAI 最好的代理工具调用模型,在客户支持和深入研究等实际用例中表现出色。 2M上下文窗口。

文本生成
上下文 2M · 输出 2M1.872 / 出 4.68 元/百万tokens
查看详情
可用
XAI

Grok 4.20

Grok 4.20 是 xAI 最新的旗舰型号,具有业界领先的速度和代理工具调用能力。它将市场上最低的幻觉率与严格的及时遵守结合起来,提供始终如一的精确和真实的反应。

文本生成
上下文 2M · 输出 2M18.72 / 出 56.16 元/百万tokens
查看详情
可用
OPENAI

GPT-5.4 Mini

GPT-5.4 mini 将 GPT-5.4 的核心功能引入更快、更高效的模型,并针对高吞吐量工作负载进行了优化。它支持文本和图像输入,在推理、编码和工具使用方面具有强大的性能,同时减少大规模部署的延迟和成本。 该模型专为需要功能和效率平衡的生产环境而设计,非常适合大规模运行的聊天应用程序、编码助手和代理工作流程。…

文本生成
上下文 4K · 输出 4K7.02 / 出 42.12 元/百万tokens
查看详情
可用
阿里通义

Qwen3.5-flash

Qwen3.5原生视觉语言Flash模型基于混合架构构建,将线性注意力机制与稀疏专家混合模型相结合,实现更高的推理效率。与 3 系列相比,这些模型在纯文本和多模式任务方面实现了性能飞跃,提供快速响应时间,同时平衡推理速度和整体性能。

文本生成
上下文 1M · 输出 82K0.2753 / 出 2.7529 元/百万tokens
查看详情
可用
阿里通义

Qwen3.5-plus

Qwen3.5原生视觉语言系列Plus模型基于混合架构构建,将线性注意力机制与稀疏混合专家模型相结合,实现更高的推理效率。在各种任务评估中,3.5 系列始终表现出与最先进的领先型号相当的性能。与 3 系列相比,这些模型在纯文本和多模式功能方面都显示出飞跃。

文本生成
上下文 1M · 输出 82K1.1012 / 出 2.7529 元/百万tokens
查看详情
可用
OPENAI

GPT 5.4

GPT-5.4 是 OpenAI 的最新前沿模型,将 Codex 和 GPT 系列统一到一个系统中。它具有 1M+ 令牌上下文窗口(922K 输入,128K 输出),支持文本和图像输入,可在同一工作流程中实现高上下文推理、编码和多模式分析。 该模型在编码、文档理解、工具使用和指令遵循方面提供了改进的性能。它被设计为通…

文本生成
上下文 1M · 输出 128K23.4 / 出 140.4 元/百万tokens
查看详情
可用
GOOGLE

Gemini 3 Flash Preview

Gemini 3 Flash Preview 是一种高速、高价值的思维模型,专为代理工作流程、多轮聊天和编码辅助而设计。它提供接近专业级的推理和工具使用性能,并且延迟比较大的 Gemini 变体低得多,使其非常适合交互式开发、长时间运行的代理循环和协作编码任务。与 Gemini 2.5 Flash 相比,它在推理、多模…

文本生成
上下文 1M · 输出 66K4.68 / 出 28.08 元/百万tokens
查看详情
可用
GOOGLE

Gemini 3.1 Pro Preview

Gemini 3.1 Pro Preview 是 Google 的前沿推理模型,可提供增强的软件工程性能、改进的代理可靠性以及在复杂工作流程中更有效的令牌使用。它建立在 Gemini 3 系列的多模态基础上,将文本、图像、视频、音频和代码的高精度推理与 1M 令牌上下文窗口相结合。

文本生成
上下文 1M · 输出 65K18.72 / 出 112.32 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Sonnet 4.6

Sonnet 4.6 是 Anthropic 迄今为止最强大的 Sonnet 级模型,在编码、代理和专业工作方面具有前沿性能。它擅长迭代开发、复杂的代码库导航、带内存的端到端项目管理、精美的文档创建以及自信地使用计算机进行 Web QA 和工作流程自动化。

文本生成
上下文 1M · 输出 128K28.08 / 出 140.4 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Opus 4.6

Opus 4.6 是 Anthropic 最强大的编码和长期运行专业任务模型。它是为跨整个工作流程而不是单个提示操作的代理而构建的,这使得它对于大型代码库、复杂的重构和随着时间的推移而展开的多步骤调试特别有效。与前几代模型相比,该模型显示出更深入的背景理解、更强的问题分解以及在艰巨的工程任务上更高的可靠性。 除了编码…

文本生成
上下文 1M · 输出 128K46.8 / 出 234 元/百万tokens
查看详情
可用
字节豆包

Doubao-Seed-1.6

Doubao-Seed-1.6全新多模态深度思考模型,同时支持minimal/low/medium/high 四种reasoning effort。 更强模型效果,服务复杂任务和有挑战场景。支持 256k 上下文窗口,输出长度支持最大 32k tokens。

文本生成
上下文 256K · 输出 224K1.1012 / 出 11.0118 元/百万tokens
查看详情
可用
OPENAI

GPT 5.2

GPT-5.2是GPT-5系列中最新的前沿级模型,与GPT-5.1相比,提供更强的代理和长上下文性能。它使用自适应推理来动态分配计算,快速响应简单的查询,同时更深入地处理复杂的任务。 GPT-5.2 专为广泛的任务覆盖而构建,可在数学、编码、科学和工具调用工作负载方面提供一致的收益,并提供更连贯的长格式答案并提高工具…

文本生成
上下文 400K · 输出 128K16.38 / 出 131.04 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Opus 4.5 20251101

Claude Opus 4.5 是 Anthropic 的前沿推理模型,针对复杂的软件工程、代理工作流程和长期计算机使用进行了优化。它提供了强大的多模式功能、跨现实世界编码和推理基准的竞争性能,以及改进的提示注入稳健性。该模型旨在在不同的工作水平上高效运行,使开发人员能够根据任务要求权衡速度、深度和令牌使用情况。它配备…

文本生成
上下文 200K · 输出 64K46.8 / 出 234 元/百万tokens
查看详情
可用
OPENAI

GPT 5.1

GPT-5.1是GPT-5系列中最新的前沿级模型,与GPT-5相比,提供更强的通用推理、更高的指令依从性以及更自然的对话风格。它使用自适应推理来动态分配计算,快速响应简单的查询,同时更深入地处理复杂的任务。该模型提供了更清晰、更基础的解释,并减少了行话,使得即使在技术或多步骤问题上也更容易理解。 GPT-5.1 专为…

文本生成
上下文 400K · 输出 128K11.7 / 出 93.6 元/百万tokens
查看详情
可用
ANTHROPIC

claude-sonnet-4-5-20250929

Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对现实世界的代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准上提供了最先进的性能,并在系统设计、代码安全性和规范遵守方面进行了改进。该模型专为扩展自主操作而设计,保持跨会话的任务连续性…

文本生成
上下文 200K · 输出 64K28.08 / 出 140.4 元/百万tokens
查看详情
可用
ANTHROPIC

claude-haiku-4-5-20251001

Claude Haiku 4.5 是 Anthropic 最快、最高效的模型,以较大 Claude 模型的一小部分成本和延迟提供近前沿的智能。 Haiku 4.5 与 Claude Sonnet 4 在推理、编码和计算机使用任务方面的性能相匹配,为实时和大容量应用程序带来了前沿水平的功能。

文本生成
上下文 200K · 输出 64K9.36 / 出 46.8 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Opus 4.5

Claude Opus 4.5 是 Anthropic 的前沿推理模型,针对复杂的软件工程、代理工作流程和长期计算机使用进行了优化。它提供了强大的多模式功能、跨现实世界编码和推理基准的竞争性能,以及改进的提示注入稳健性。该模型旨在在不同的工作水平上高效运行,使开发人员能够根据任务要求权衡速度、深度和令牌使用情况。它配备…

文本生成
上下文 200K · 输出 32K46.8 / 出 234 元/百万tokens
查看详情
可用
OPENAI

gpt-4o

OpenAI ChatGPT 4o 由 OpenAI 不断更新,以指向 ChatGPT 使用的当前版本的 GPT-4o。因此,它与 GPT-4o 的 API 版本略有不同,因为它具有额外的 RLHF。它旨在用于研究和评估。 OpenAI 指出,该模型不适合生产用例,因为它将来可能会被删除或重定向到另一个模型。

文本生成
上下文 128K · 输出 16K23.4 / 出 93.6 元/百万tokens
查看详情
可用
OPENAI

gpt-4o-mini

GPT-4o mini是OpenAI继GPT-4 Omni之后的最新型号,支持文本和图像输入以及文本输出。 作为他们最先进的小型型号,它比其他近期前沿型号便宜很多倍,比 GPT-3.5 Turbo 便宜 60% 以上。它保持了 SOTA 智能,同时显着提高了成本效益。

文本生成
上下文 128K · 输出 16K1.404 / 出 5.616 元/百万tokens
查看详情
可用
字节豆包

Doubao-Seed-1.6-flash

Doubao-Seed-1.6-flash推理速度极致的多模态深度思考模型,TPOT低至10ms; 同时支持文本和视觉理解,文本理解能力超过上一代lite,视觉理解比肩友商pro系列模型。支持 256k 上下文窗口,输出长度支持最大 16k tokens。

文本生成
上下文 256K · 输出 32K0.2065 / 出 2.0647 元/百万tokens
查看详情
可用
字节豆包

Doubao-1.5-thinking-pro

Doubao-Seed-1.6全新多模态深度思考模型,同时支持minimal/low/medium/high 四种reasoning effort。 更强模型效果,服务复杂任务和有挑战场景。支持 256k 上下文窗口,输出长度支持最大 32k tokens。

文本生成
上下文 256K · 输出 32K5.5059 / 出 22.0235 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Sonnet 4

Claude Sonnet 4 显着增强了其前身 Sonnet 3.7 的功能,在编码和推理任务方面表现出色,并提高了精度和可控性。 Sonnet 4 在 SWE-bench 上实现了最先进的性能 (72.7%),平衡了功能和计算效率,使其适用于从常规编码任务到复杂软件开发项目的广泛应用。主要增强功能包括改进的自主代码…

文本生成
上下文 1M · 输出 64K28.08 / 出 140.4 元/百万tokens
查看详情
可用
OPENAI

o4-mini

OpenAI o4-mini 是 o 系列中的紧凑推理模型,针对快速、经济高效的性能进行了优化,同时保留了强大的多模式和代理功能。它支持工具使用,并在 AIME(Python 为 99.5%)和 SWE-bench 等基准测试中展示了具有竞争力的推理和编码性能,优于其前身 o3-mini,甚至在某些领域接近 o3。…

文本生成
上下文 200K · 输出 10K10.296 / 出 41.184 元/百万tokens
查看详情
可用
智谱AI

GLM-4.5

GLM-4.5 是我们最新的旗舰基础模型,专为基于代理的应用程序而构建。它利用专家混合 (MoE) 架构并支持高达 128k 令牌的上下文长度。 GLM-4.5 在推理、代码生成和代理对齐方面提供了显着增强的功能。它支持具有两种选项的混合推理模式,一种是专为复杂推理和工具使用而设计的“思维模式”,另一种是针对即时响应而…

文本生成
上下文 131K · 输出 15K2.7529 / 出 11.0118 元/百万tokens
查看详情
可用
智谱AI

GLM-4.6

GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B,上下文提升至 200K,8 大权威基准全面提升。在编程、推理、搜索、写作、智能体应用等核心能力均完成对 GLM-4.5 的超越。

文本生成
上下文 200K · 输出 13K2.7529 / 出 8.2588 元/百万tokens
查看详情
可用
百度

ERNIE 5.0

​文心新一代模型文心5.0是原生全模态大模型,采用原生的全模态统一建模技术,将文本、图像、音频、视频联合建模,具备综合的全模态能力。文心5.0基础能力全面升级,基准测试集表现出色,多模态理解、指令遵循、创意写作、事实性、智能体规划与工具应用等表现尤其出色。

文本生成
上下文 128K · 输出 66K8.2588 / 出 33.0353 元/百万tokens
查看详情
可用
百度

ERNIE 4.5 Turbo

​核心定位:更好的满足多轮长历史对话处理、长文档理解问答任务。 ​适用场景:​ 1)复杂语义理解:支持中文知识问答、文学创作,尤其擅长文档理解(如DocVQA任务)。 ​ 2)数学推理:在中文数学问题(CMath基准)表现突出。 ​

文本生成
上下文 128K · 输出 12K11.0118 / 出 44.0471 元/百万tokens
查看详情
可用
智谱AI

GLM-4.5V

GLM-4.5VGLM-4.5V 系列是基于 MOE 架构的旗舰视觉理解模型。拥有 106B 总参数量和 12B 激活参数,全面升级自 GLM-4.1V-Thinking,达到开源多模态模型 SOTA 水平。结合创新 RLCS 强化学习技术,在视频理解、图片问答、OCR、文档解析等任务表现优异,并在前端网页 Codin…

文本生成
上下文 128K · 输出 64K2.7529 / 出 8.2588 元/百万tokens
查看详情
可用
字节豆包

Doubao-lite-32k

Doubao-Seed-1.6-lite 全新多模态深度思考模型,支持思考程度可调节(reasoning effort),即Minimal、Low、Medium、High 四种模式,更强性价比,常见任务的最佳选择,上下文窗口至256k。

文本生成
上下文 4K · 输出 4K0.4129 / 出 0.8259 元/百万tokens
查看详情
可用
字节豆包

Doubao-pro-32k

Doubao-1.5-vision-pro 全新升级的多模态大模型,视觉理解、分类、信息抽取、解题、视频理解等能力显著提升。在多个公开评测集准上,令领先GPT-40、Claude 3.7 Sonnet、Gemini-2.0-pro等业界一流模型。支持128k上下文窗口,输出长度支持最大 16k tokens。

文本生成
上下文 4K · 输出 4K1.1012 / 出 2.7529 元/百万tokens
查看详情
可用
GOOGLE

Gemini 2.5 Flash

Gemini 2.5 Flash 是 Google 最先进的主力模型,专为高级推理、编码、数学和科学任务而设计。它包括内置的“思考”功能,使其能够提供更准确的响应和细致入微的上下文处理。 此外,Gemini 2.5 Flash 可通过“推理的最大令牌”参数进行配置,如文档中所述

文本生成
上下文 1M · 输出 25K2.808 / 出 23.4 元/百万tokens
查看详情
可用
GOOGLE

Gemini 2.5 Pro

Gemini 2.5 Pro 是 Google 最先进的 AI 模型,专为高级推理、编码、数学和科学任务而设计。它采用“思考”功能,使其能够通过提高准确性和细致入微的上下文处理的响应进行推理。 Gemini 2.5 Pro 在多项基准测试中实现了顶级性能,包括在 LMArena 排行榜上排名第一,体现了卓越的人类偏好一…

文本生成
上下文 1M · 输出 10K11.7 / 出 93.6 元/百万tokens
查看详情
可用
OPENAI

GPT-5 Nano

GPT-5-Nano 是 GPT-5 系统中最小、最快的变体,针对开发人员工具、快速交互和超低延迟环境进行了优化。虽然与较大的同类产品相比推理深度有限,但它保留了关键的指令遵循和安全功能。它是 GPT-4.1-nano 的后继者,为成本敏感或实时应用程序提供了轻量级选项。

文本生成
上下文 400K · 输出 10K1.872 / 出 11.7 元/百万tokens
查看详情
可用
OPENAI

GPT-5 Mini

GPT-5 Mini 是 GPT-5 的紧凑版本,旨在处理更轻量级的推理任务。它提供与 GPT-5 相同的指令跟踪和安全调整优势,但延迟和成本更低。 GPT-5 Mini 是 OpenAI o4-mini 模型的后继者。

文本生成
上下文 400K · 输出 10K2.34 / 出 18.72 元/百万tokens
查看详情
可用
OPENAI

GPT-5

GPT-5 是 OpenAI 最先进的模型,在推理、代码质量和用户体验方面提供了重大改进。它针对需要逐步推理、遵循指令以及高风险用例中的准确性的复杂任务进行了优化。它支持测试时路由功能和高级提示理解,包括用户指定的意图,例如“认真考虑一下”。改进包括减少幻觉、阿谀奉承,以及在编码、写作和健康相关任务中表现更好。

文本生成
上下文 400K · 输出 10K11.7 / 出 93.6 元/百万tokens
查看详情
可用
OPENAI

GPT-4.1 Mini

GPT-4.1 Mini 是一款中型型号,其性能可与 GPT-4o 相媲美,但延迟和成本却显着降低。它保留了 100 万个令牌上下文窗口,在硬指令评估上得分为 45.1%,在 MultiChallenge 上得分为 35.8%,在 IFEval 上得分为 84.1%。 Mini 还表现出强大的编码能力(例如,在 Aid…

文本生成
上下文 1M · 输出 10K3.744 / 出 14.976 元/百万tokens
查看详情
可用
OPENAI

GPT-4.1

GPT-4.1 是一款旗舰级大型语言模型,针对高级指令遵循、现实世界软件工程和长上下文推理进行了优化。它支持 100 万个令牌上下文窗口,并且在编码(54.6% SWE-bench 验证)、指令合规性(87.4% IFEval)和多模式理解基准方面优于 GPT-4o 和 GPT-4.5。它针对精确的代码差异、代理可靠性…

文本生成
上下文 1M · 输出 8K18.72 / 出 74.88 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Opus 4.1

Claude Opus 4.1 是 Anthropic 旗舰模型的更新版本,在编码、推理和代理任务方面提供了改进的性能。它在 SWE-bench Verified 上达到了 74.5%,并在多文件代码重构、调试精度和面向细节的推理方面显示出显着的进步。该模型支持高达 64K token 的扩展思维,并针对涉及研究、数据…

文本生成
上下文 200K · 输出 64K140.4 / 出 702 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Haiku 4.5

Claude Haiku 4.5 是 Anthropic 最快、最高效的模型,以较大 Claude 模型的一小部分成本和延迟提供近前沿的智能。 Haiku 4.5 与 Claude Sonnet 4 在推理、编码和计算机使用任务方面的性能相匹配,为实时和大容量应用程序带来了前沿水平的功能。 它引入了俳句的扩展思维;实…

文本生成
上下文 200K · 输出 64K9.36 / 出 46.8 元/百万tokens
查看详情
可用
ANTHROPIC

Claude Sonnet 4.5

Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对现实世界的代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准上提供了最先进的性能,并在系统设计、代码安全性和规范遵守方面进行了改进。该模型专为扩展自主操作而设计,保持跨会话的任务连续性…

文本生成
上下文 200K · 输出 64K28.08 / 出 140.4 元/百万tokens
查看详情
可用

GPT Image 2

官方直连(图像生成),按元/张计费,单价已含人民币换算。

图片生成按张计价
按张计价¥1.0796 / 张
查看详情
可用

Nano Banana Pro

官方直连(图像生成),按元/张计费,单价已含人民币换算。

图片生成按张计价
按张计价¥1.258 / 张
查看详情
可用

Nano Banana 2

官方直连(图像生成),按元/张计费,单价已含人民币换算。

图片生成按张计价
按张计价¥0.629 / 张
查看详情
可用

Nano Banana

官方直连(图像生成),按元/张计费,单价已含人民币换算。

图片生成按张计价
按张计价¥0.3622 / 张
查看详情
可用

FLUX.2 Flex

官方直连(图像生成),按元/张计费,单价已含人民币换算。

图片生成按张计价
按张计价¥0.5889 / 张
查看详情
可用

FLUX.2 Max

官方直连(图像生成),按元/张计费,单价已含人民币换算。

图片生成按张计价
按张计价¥0.687 / 张
查看详情
可用

FLUX.2 Pro

官方直连(图像生成),按元/张计费,单价已含人民币换算。

图片生成按张计价
按张计价¥0.2944 / 张
查看详情
可用

D图像-Flux·flux1_dev 基础生图

我们自研的生图能力(局域网算力直连),按元/张计费,数据不出内网。

图片生成按张计价
按张计价¥0.1 / 张
查看详情
可用

MiniMax-H3 九图版 视频(LAN 0.15元/秒)

我们自研的生视频能力(局域网算力直连),按元/秒计费,数据不出内网。

视频生成按秒计价
按秒计价¥0.15 / 秒
查看详情
可用

MiniMax-H3 极速10S(LAN 0.1元/秒)

我们自研的生视频能力(局域网算力直连),按元/秒计费,数据不出内网。

视频生成按秒计价
按秒计价¥0.1 / 秒
查看详情
可用

A08-洗图-Qwen二次元转真人高清放大(LAN 0.1元/张)

我们自研的生图能力(局域网算力直连),按元/张计费,数据不出内网。

图片生成按张计价
按张计价¥0.1 / 张
查看详情
可用

C16-短剧文生图专用-支持场景-角色(LAN 0.1元/张)

我们自研的生图能力(局域网算力直连),按元/张计费,数据不出内网。

图片生成按张计价
按张计价¥0.1 / 张
查看详情
可用

C19-人物设定三视图zimage双采(LAN 0.1元/张)

我们自研的生图能力(局域网算力直连),按元/张计费,数据不出内网。

图片生成按张计价
按张计价¥0.1 / 张
查看详情
没有符合筛选条件的模型

按量计费 · 行业标准单位

价格按 元 / 百万 tokens 展示:扣费 = 全价输入tokens × 输入价/1M + 输出tokens × 输出价/1M + 缓存 tokens × 缓存价/1M(全价输入 = prompt_tokens − 缓存命中 tokens,命中部分不重复计输入价)。
缓存命中 / 缓存写入按各模型公布的缓存价计费,标注 FREE 的项该模型免费、我方不计费。明细在控制台逐条可查,注册即送体验余额。

查看定价