Skip to content

模型介绍 ​

BaseURL ​

https://chat.ecnu.edu.cn/open/api/v1

以下是我们目前支持的模型列表。当前对话模型统一收敛为 ecnu-max 和 ecnu-plus 两个主模型,其余历史模型名称作为兼容别名保留。

模型的 credits 计算、配额限制和别名计费规则详见 配额限制。

单个用户对每个模型的并发请求上限为 3(ecnu-max 与 ecnu-plus 分别计算,互不占用),超额请求会直接返回错误(详见 配额限制);建议避免并行调用 API 服务,等上一个响应结束后再发起下一个请求,以获得更稳定的服务。

服务状态 ​

如需查看模型服务的实时状态和可用性,请访问服务状态页面。

对话模型 ​

所有对话模型均已完成本地部署,数据处理和响应均在校内服务器完成。

模型ecnu-maxecnu-plus
BASE URL(OpenAI 格式)https://chat.ecnu.edu.cn/open/api/v1
BASE URL(Anthropic 格式)https://chat.ecnu.edu.cn/open/api/anthropic
底层模型DeepSeek-V4.1-FlashQwen3.8-Flash-Next
定位旗舰模型,适合高质量复杂任务通用模型,兼顾效果、成本与响应速度
思考模式支持,默认关闭,通过 thinking 参数开启
思考强度(reasoning_effort)low / high / maxlow / medium / xhigh
上下文长度512K256K
输出长度最大 384K最大 128K
功能结构化输出(Json Output)支持支持
Tool Calls支持支持
Responses API支持支持
Anthropic API支持支持
图像理解支持支持
价格
(credits / 1M tokens)
输入(缓存命中)· 谷时6020
输入(缓存命中)· 峰时12040
输入(缓存未命中)· 谷时300100
输入(缓存未命中)· 峰时600200
输出 · 谷时1200400
输出 · 峰时2400800
并发请求上限33

价格为 credits / 1M tokens,峰时为每天 8:00-18:00(国庆假期期间不执行峰价),谷时为其余时间;完整计费口径与配额规则见 配额限制。

并发请求上限按用户(令牌)+ 模型分别统计:ecnu-max 与 ecnu-plus 各自独立计算,同一时间可各有 3 个请求在处理中,两者互不占用;超出上限的请求会直接返回错误(HTTP 429)。

备注 ​

针对校内专属AI应用场景(例如 ChatECNU,Agent 平台等),我们将调度模型请求至独立的服务集群以保障服务的稳定性。

如果您的业务对模型响应稳定性有较高要求,请与我们单独联系

默认参数 ​

建议参考模型官方文档,合理设置 temperature、top_p 等参数,以获得更符合预期的响应效果。

思考模式 ​

所有对话模型均支持通过 thinking 参数开启思考模式,并可通过 reasoning_effort 控制思考强度:ecnu-max 支持 low / high / max,ecnu-plus 支持 low / medium / xhigh。详细的用法、示例与多轮拼接规则见 思考模式。

点击右侧"开放接口 → 兼容接口"中的 Anthropic 兼容 API 与 Responses API 兼容 可查看兼容接口下如何通过 output_config.effort / reasoning.effort 指定思考强度。

兼容别名 ​

为保持历史兼容,平台仍保留原有模型名称。新接入应用建议优先使用 ecnu-max 或 ecnu-plus。

历史模型名当前等价模型说明
ecnu-reasonerecnu-max + thinking: {"type": "enabled"}默认开启思考模式的 ecnu-max
ecnu-reasoner-liteecnu-plus + thinking: {"type": "enabled"}默认开启思考模式的 ecnu-plus
ecnu-turboecnu-plus历史兼容别名
ecnu-vlecnu-plus历史兼容别名
InnoSparkecnu-plus历史兼容别名
educhat-r1ecnu-plus历史兼容别名
educhat-generalecnu-plus历史兼容别名
educhat-psychologyecnu-plus历史兼容别名
ChatECNUecnu-plus历史兼容别名
gpt-4ecnu-plus兼容 gpt-4 的历史模型名

向量和重排模型 ​

模型名底层模型能力说明上下文
ecnu-embedding-smallbge-m3通用文本向量能力,1024 维8K
ecnu-embedding-vlQwen3-VL-Embedding-8B多模态向量能力,支持文本、图片(PNG/JPEG base64)及图文混合输入,默认 4096 维(可指定 1024/2048/4096),适合多模态 RAG32K
ecnu-rerankbge-reranker-v2-m3通用文本重排序8K
ecnu-rerank-vlQwen3-VL-Reranker-8B多模态重排序,query 与 documents 均可包含文本、图片及图文组合32K

ecnu-embedding-vl / ecnu-rerank-vl 的调用方式详见 通用文本向量 与 通用文本重排序。

文生图与语音模型 ​

模型名底层模型能力说明备注
ecnu-imageqwen-image-2.1通用文生图与图像编辑(修改、重绘、风格变换等),详见 通用图像编辑文生图提示词自动扩写;图像编辑指令只做安全审核、原样透传
ecnu-ttsFun-CosyVoice3-0.5B通用文本转语音,支持 16 种音色输入不超过 4096

本地部署与数据安全 ​

所有模型均已完成本地化部署,数据处理和响应默认均在校内服务器完成,详见 本地部署与数据安全。

重要变更 ​

2026-10-01:ecnu-max 底层模型更新为 DeepSeek-V4.1-Flash,原生支持多模态(图片理解),图片场景无需再切换到其他模型。

2026-10-01:ecnu-plus 底层模型更新为 Qwen3.8-Flash-Next,响应速度与文本、多模态能力进一步提升。

2026-09-30:新增多模态向量模型 ecnu-embedding-vl 与多模态重排序模型 ecnu-rerank-vl,支持图文混合输入;ecnu-image 新增图像编辑能力,开放接口新增 通用图像编辑。

2026-09-30:峰谷计费时段调整为每天 8:00-18:00 为峰时(国庆假期不执行峰价),ecnu-max 与 ecnu-plus 峰时 credits 消耗仍为 2 倍,详见 配额限制。

2026-09-21:ecnu-plus 的思考强度新增 xhigh 档位,现可选 low / medium / xhigh;ecnu-max 的档位保持 low / high / max 不变,详见 思考模式。

2026-09-18:ecnu-plus 支持通过 reasoning_effort 控制思考强度,可选档位为 low / medium;ecnu-max 的档位为 low / high / max,详见 思考模式。

2026-09-18:ecnu-max 的上下文长度调整为 512K,底层模型保持 DeepSeek-V4-Flash-0731,暂不支持图片理解(图片场景请使用 ecnu-plus)。我们会在算力压力缓解、性能优化改善后,重新部署 DeepSeek-V4.1-Flash。

2026-09-18:单个用户对每个模型的并发请求上限调整为 3(ecnu-max 与 ecnu-plus 分别计算);ecnu-max 与 ecnu-plus 改为峰谷计费,周一至周五 8:00-23:00 为峰时,credits 消耗翻倍。详见 配额限制。

2026-08-31:ecnu-plus 已更新模型为 Qwen3.8-27B。

2026-08-31:ecnu-plus 与 ecnu-max 均支持基于 response_format 的结构化输出,详见 结构化输出。

2026-08-03:ecnu-tts 已更新模型为 Fun-CosyVoice3-0.5B,并新增多种音色,详见 文本转语音。

2026-08-01:ecnu-max 已更新模型为 DeepSeek-V4-Flash-0731。

2026-04-24:ecnu-max 将于 2026-04-27 更新模型为 DeepSeek-V4-Flash,升级后模型能力将有显著提升,但不再支持图片理解能力。如果您的服务依赖于图片理解能力,请尽快切换到 ecnu-plus 或其他支持图片理解的模型。

2026-04-03:对话模型统一收敛为 ecnu-max 和 ecnu-plus 两个主模型,历史模型名称作为兼容别名保留;支持通过 thinking: {"type": "enabled"} 开启思考模式。

2025-03-20: 由于模型架构升级调整,原生的 联网搜索 能力已经下线。如果您的业务依赖 API 接口原生的 联网搜索 能力,请尽快切换到其他方案。