统一模型目录模型广场
12 个模型配置在同一套目录中检索、筛选和比较模型,确认协议与计价后再进入接入流程。
当前目录为本地产品原型:价格、模型状态与接口地址均为演示配置,“待接入”模型尚未连接任何上游服务。
共 12 个结果展示全部配置
演示配置200K 上下文均衡
兼顾推理、编码与长文本处理的通用模型配置。
演示计价 · ¥ / 1M tokens输入¥3输出¥15缓存¥0.30
长文本代码视觉
演示配置200K 上下文极速
面向高并发、低延迟场景的轻量模型配置。
演示计价 · ¥ / 1M tokens输入¥0.80输出¥4缓存¥0.08
低延迟批处理视觉
演示配置128K 上下文极速
适合摘要、分类、抽取与在线客服的经济型配置。
演示计价 · ¥ / 1M tokens输入¥0.40输出¥1.60缓存¥0.04
低成本分类抽取
演示配置1M 上下文极速
偏重速度与吞吐量的多模态模型配置。
演示计价 · ¥ / 1M tokens输入¥0.30输出¥2.50缓存¥0.03
高吞吐低延迟多模态
演示配置128K 上下文极速
面向高频文本处理和实时应用的轻量配置。
演示计价 · ¥ / 1M tokens输入¥0.25输出¥1缓存¥0.03
实时批处理中文
演示配置64K 上下文极速
适合低成本、大规模在线请求的轻量模型配置。
演示计价 · ¥ / 1M tokens输入¥0.15输出¥0.60缓存¥0.02
低成本高并发中文
待接入128K 上下文均衡
覆盖工具调用、结构化输出与多模态任务的通用配置。
演示计价 · ¥ / 1M tokens输入¥2.50输出¥10缓存¥0.25
工具调用结构化输出多模态
待接入1M 上下文深度
适合复杂分析、长上下文理解与多模态工作流。
演示计价 · ¥ / 1M tokens输入¥1.25输出¥10缓存¥0.13
超长上下文多模态推理
待接入128K 上下文均衡
面向中文对话、代码生成与通用任务的模型配置。
演示计价 · ¥ / 1M tokens输入¥0.28输出¥1.10缓存¥0.03
中文代码低成本
DeepSeek
DeepSeek Reasoner
待接入128K 上下文深度
用于数学、逻辑与复杂规划任务的深度推理配置。
演示计价 · ¥ / 1M tokens输入¥0.55输出¥2.20缓存¥0.06
深度推理数学规划
待接入128K 上下文均衡
适合中文内容生产、知识问答与企业工作流。
演示计价 · ¥ / 1M tokens输入¥0.90输出¥3.60缓存¥0.09
中文知识问答视觉
待接入128K 上下文均衡
覆盖内容生成、信息抽取和智能客服的模型配置。
演示计价 · ¥ / 1M tokens输入¥0.80输出¥2缓存¥0.08
中文客服视觉