AI 模型市场
浏览全部可用 AI 模型,比较价格与能力,几分钟即可接入。当前开放 21 个模型,持续扩充。 另有 1 个暂未开放。

GPT-5.6
GPT-5.6 家族:Sol 前沿旗舰、Terra 日常均衡、Luna 快而省,一个家族从前沿智能覆盖到高速执行。切换 Model Type 选择档位。

GPT-5.5
GPT-5.5 提供业界领先的对话、推理与代码能力,支持流式输出、长上下文与结构化任务。完全兼容 OpenAI SDK,可直接接入 Codex / Cursor / Claude Code 等工具,零改造迁移。

GPT-6 Astra
GPT-6 Astra 是 OpenAI 于 2026 年 9 月发布的新一代旗舰模型:105 万 token 上下文、最高 12.8 万 token 输出,支持 reasoning_effort 五档调节(最高 xhigh)、图片输入、工具调用与提示缓存。完全兼容 OpenAI SDK,把 model 改成 gpt-6-astra 即可接入,同时支持 /chat/completions 与 /responses。按量计费、失败不计费;命中缓存的输入按 1/10 计价,且不加收官方在超长上下文上的附加费。

Claude Sonnet 4.6
Claude Sonnet 4.6 在能力与速度间取得出色平衡,擅长日常对话、代码与 Agent,性价比高。完全兼容 OpenAI 接口,把 model 改成 claude-sonnet-4-6 即可接入。

Claude Opus 5
Claude Opus 5 是 Anthropic 新一代旗舰模型,默认开启自适应思考,长于复杂推理、代码工程与 Agent 编排,支持图片理解、工具调用与提示缓存。完全兼容 OpenAI 接口,把 model 改成 claude-opus-5 即可接入;也可用原生 Anthropic Messages 接口让 Claude Code 直连。

Claude Fable 5
Claude Fable 5 是 Anthropic Fable 系列模型,与 Opus 5 同代、同一套能力底座(自适应思考、工具调用、图片理解、提示缓存),在中文叙事与长文写作上笔触更细腻、情绪层次更完整。完全兼容 OpenAI 接口,把 model 改成 claude-fable-5 即可接入;同样支持原生 Anthropic Messages 接口。

Gemini 3.1 Pro
Gemini 3.1 Pro 是 Google 新一代旗舰多模态模型,具备超长上下文、顶级推理与代码能力。完全兼容 OpenAI 接口,只需把 model 改成 gemini-3.1-pro 即可在现有 SDK 中直接调用;默认低推理档(更快更省),传 reasoning_effort=high 切换高推理档(Preview 档计价)。返回结果附带 reasoning_content 字段,可直接看到模型的思考过程(流式同样逐块下发)。

Gemini 3.8 Flash
Gemini 3.8 Flash 是 Google 2026 年 9 月发布的最新一代 Flash 模型,面向长周期编程、Agent 工作流与复杂推理,1M token 上下文、最高 64K 输出,支持图片输入。采用动态思考预算:简单问题快答、难题自动多想。完全兼容 OpenAI 接口,把 model 改成 gemini-3.8-flash 即可接入。

Gemini 3.7 Flash
Gemini 3.7 Flash 是 3.8 的前一代,同样采用动态思考预算,1M token 上下文、支持图片输入。适合已经按 3.7 调好提示词、暂时不想切换的场景。完全兼容 OpenAI 接口,把 model 改成 gemini-3.7-flash 即可接入。

Gemini 3.6 Flash
Gemini 3.6 Flash 家族:同一个模型的四档思考预算——Medium 日常均衡、High 深度推理、Low 极速低耗、Tiered 由模型按难度自动调档。四档同价,思考得多自然按输出 token 多算。1M 上下文、支持图片输入。切换 Model Type 选择档位。

Gemini 3 Flash
Gemini 3 Flash 主打高速与高性价比,适合大批量、低延迟的对话与 Agent 场景。完全兼容 OpenAI 接口,支持流式输出,把 model 改成 gemini-3-flash-preview 即可接入。

Gemini 3.5 Flash
Gemini 3.5 Flash 是 Google 新一代高速模型,内置思考能力,速度快、性价比高,适合大批量对话与 Agent 场景。完全兼容 OpenAI 接口,把 model 改成 gemini-3.5-flash 即可接入。

Gemini 2.5 Flash
Gemini 2.5 Flash 主打高速与高性价比,适合规模化、低延迟的对话与 Agent 场景,并支持多模态输入。完全兼容 OpenAI 接口,把 model 改成 gemini-2.5-flash 即可接入。








