统一模型目录

模型广场

12 个模型配置

在同一套目录中检索、筛选和比较模型,确认协议与计价后再进入接入流程。

6提供商分类
3兼容协议
¥ / 1M统一价格口径

当前目录为本地产品原型:价格、模型状态与接口地址均为演示配置,“待接入”模型尚未连接任何上游服务。

12 个结果展示全部配置
Anthropic

Claude Sonnet

演示配置200K 上下文均衡

兼顾推理、编码与长文本处理的通用模型配置。

输入
协议MessagesChat
演示计价 · ¥ / 1M tokens
输入¥3输出¥15缓存¥0.30
长文本代码视觉
Anthropic

Claude Haiku

演示配置200K 上下文极速

面向高并发、低延迟场景的轻量模型配置。

输入
协议MessagesChat
演示计价 · ¥ / 1M tokens
输入¥0.80输出¥4缓存¥0.08
低延迟批处理视觉
OpenAI

GPT Mini

演示配置128K 上下文极速

适合摘要、分类、抽取与在线客服的经济型配置。

输入
协议ChatResponses
演示计价 · ¥ / 1M tokens
输入¥0.40输出¥1.60缓存¥0.04
低成本分类抽取
Google

Gemini Flash

演示配置1M 上下文极速

偏重速度与吞吐量的多模态模型配置。

输入
协议ChatResponses
演示计价 · ¥ / 1M tokens
输入¥0.30输出¥2.50缓存¥0.03
高吞吐低延迟多模态
Alibaba

Qwen Turbo

演示配置128K 上下文极速

面向高频文本处理和实时应用的轻量配置。

输入
协议Chat
演示计价 · ¥ / 1M tokens
输入¥0.25输出¥1缓存¥0.03
实时批处理中文
ByteDance

Doubao Lite

演示配置64K 上下文极速

适合低成本、大规模在线请求的轻量模型配置。

输入
协议Chat
演示计价 · ¥ / 1M tokens
输入¥0.15输出¥0.60缓存¥0.02
低成本高并发中文
OpenAI

GPT General

待接入128K 上下文均衡

覆盖工具调用、结构化输出与多模态任务的通用配置。

输入
协议ChatResponses
演示计价 · ¥ / 1M tokens
输入¥2.50输出¥10缓存¥0.25
工具调用结构化输出多模态
Google

Gemini Pro

待接入1M 上下文深度

适合复杂分析、长上下文理解与多模态工作流。

输入
协议ChatResponses
演示计价 · ¥ / 1M tokens
输入¥1.25输出¥10缓存¥0.13
超长上下文多模态推理
DeepSeek

DeepSeek Chat

待接入128K 上下文均衡

面向中文对话、代码生成与通用任务的模型配置。

输入
协议Chat
演示计价 · ¥ / 1M tokens
输入¥0.28输出¥1.10缓存¥0.03
中文代码低成本
DeepSeek

DeepSeek Reasoner

待接入128K 上下文深度

用于数学、逻辑与复杂规划任务的深度推理配置。

输入
协议Chat
演示计价 · ¥ / 1M tokens
输入¥0.55输出¥2.20缓存¥0.06
深度推理数学规划
Alibaba

Qwen Max

待接入128K 上下文均衡

适合中文内容生产、知识问答与企业工作流。

输入
协议Chat
演示计价 · ¥ / 1M tokens
输入¥0.90输出¥3.60缓存¥0.09
中文知识问答视觉
ByteDance

Doubao Pro

待接入128K 上下文均衡

覆盖内容生成、信息抽取和智能客服的模型配置。

输入
协议Chat
演示计价 · ¥ / 1M tokens
输入¥0.80输出¥2缓存¥0.08
中文客服视觉