模型介绍
BaseURL
https://chat.ecnu.edu.cn/open/api/v1
以下是我们目前支持的模型列表。当前对话模型统一收敛为 ecnu-max 和 ecnu-plus 两个主模型,其余历史模型名称作为兼容别名保留。
模型的 credits 计算、配额限制和别名计费规则详见 配额限制。
单个用户对每个模型的并发请求上限为 3(ecnu-max 与 ecnu-plus 分别计算,互不占用),超额请求会直接返回错误(详见 配额限制);建议避免并行调用 API 服务,等上一个响应结束后再发起下一个请求,以获得更稳定的服务。
服务状态
如需查看模型服务的实时状态和可用性,请访问服务状态页面。
对话模型
所有对话模型均已完成本地部署,数据处理和响应均在校内服务器完成。
| 模型 | ecnu-max | ecnu-plus | |
|---|---|---|---|
| BASE URL(OpenAI 格式) | https://chat.ecnu.edu.cn/open/api/v1 | ||
| BASE URL(Anthropic 格式) | https://chat.ecnu.edu.cn/open/api/anthropic | ||
| 底层模型 | DeepSeek-V4.1-Flash | Qwen3.8-Flash-Next | |
| 定位 | 旗舰模型,适合高质量复杂任务 | 通用模型,兼顾效果、成本与响应速度 | |
| 思考模式 | 支持,默认关闭,通过 thinking 参数开启 | ||
思考强度(reasoning_effort) | low / high / max | low / medium / xhigh | |
| 上下文长度 | 512K | 256K | |
| 输出长度 | 最大 384K | 最大 128K | |
| 功能 | 结构化输出(Json Output) | 支持 | 支持 |
| Tool Calls | 支持 | 支持 | |
| Responses API | 支持 | 支持 | |
| Anthropic API | 支持 | 支持 | |
| 图像理解 | 支持 | 支持 | |
| 价格 (credits / 1M tokens) | 输入(缓存命中)· 谷时 | 60 | 20 |
| 输入(缓存命中)· 峰时 | 120 | 40 | |
| 输入(缓存未命中)· 谷时 | 300 | 100 | |
| 输入(缓存未命中)· 峰时 | 600 | 200 | |
| 输出 · 谷时 | 1200 | 400 | |
| 输出 · 峰时 | 2400 | 800 | |
| 并发请求上限 | 3 | 3 | |
价格为 credits / 1M tokens,峰时为每天 8:00-18:00(国庆假期期间不执行峰价),谷时为其余时间;完整计费口径与配额规则见 配额限制。
并发请求上限按用户(令牌)+ 模型分别统计:
ecnu-max与ecnu-plus各自独立计算,同一时间可各有 3 个请求在处理中,两者互不占用;超出上限的请求会直接返回错误(HTTP 429)。
备注
针对校内专属AI应用场景(例如 ChatECNU,Agent 平台等),我们将调度模型请求至独立的服务集群以保障服务的稳定性。
如果您的业务对模型响应稳定性有较高要求,请与我们单独联系
默认参数
建议参考模型官方文档,合理设置 temperature、top_p 等参数,以获得更符合预期的响应效果。
思考模式
所有对话模型均支持通过 thinking 参数开启思考模式,并可通过 reasoning_effort 控制思考强度:ecnu-max 支持 low / high / max,ecnu-plus 支持 low / medium / xhigh。详细的用法、示例与多轮拼接规则见 思考模式。
点击右侧"开放接口 → 兼容接口"中的 Anthropic 兼容 API 与 Responses API 兼容 可查看兼容接口下如何通过
output_config.effort/reasoning.effort指定思考强度。
兼容别名
为保持历史兼容,平台仍保留原有模型名称。新接入应用建议优先使用 ecnu-max 或 ecnu-plus。
| 历史模型名 | 当前等价模型 | 说明 |
|---|---|---|
ecnu-reasoner | ecnu-max + thinking: {"type": "enabled"} | 默认开启思考模式的 ecnu-max |
ecnu-reasoner-lite | ecnu-plus + thinking: {"type": "enabled"} | 默认开启思考模式的 ecnu-plus |
ecnu-turbo | ecnu-plus | 历史兼容别名 |
ecnu-vl | ecnu-plus | 历史兼容别名 |
InnoSpark | ecnu-plus | 历史兼容别名 |
educhat-r1 | ecnu-plus | 历史兼容别名 |
educhat-general | ecnu-plus | 历史兼容别名 |
educhat-psychology | ecnu-plus | 历史兼容别名 |
ChatECNU | ecnu-plus | 历史兼容别名 |
gpt-4 | ecnu-plus | 兼容 gpt-4 的历史模型名 |
向量和重排模型
| 模型名 | 底层模型 | 能力说明 | 上下文 |
|---|---|---|---|
ecnu-embedding-small | bge-m3 | 通用文本向量能力,1024 维 | 8K |
ecnu-embedding-vl | Qwen3-VL-Embedding-8B | 多模态向量能力,支持文本、图片(PNG/JPEG base64)及图文混合输入,默认 4096 维(可指定 1024/2048/4096),适合多模态 RAG | 32K |
ecnu-rerank | bge-reranker-v2-m3 | 通用文本重排序 | 8K |
ecnu-rerank-vl | Qwen3-VL-Reranker-8B | 多模态重排序,query 与 documents 均可包含文本、图片及图文组合 | 32K |
ecnu-embedding-vl / ecnu-rerank-vl 的调用方式详见 通用文本向量 与 通用文本重排序。
文生图与语音模型
| 模型名 | 底层模型 | 能力说明 | 备注 |
|---|---|---|---|
ecnu-image | qwen-image-2.1 | 通用文生图与图像编辑(修改、重绘、风格变换等),详见 通用图像编辑 | 文生图提示词自动扩写;图像编辑指令只做安全审核、原样透传 |
ecnu-tts | Fun-CosyVoice3-0.5B | 通用文本转语音,支持 16 种音色 | 输入不超过 4096 |
本地部署与数据安全
所有模型均已完成本地化部署,数据处理和响应默认均在校内服务器完成,详见 本地部署与数据安全。
重要变更
2026-10-01:ecnu-max 底层模型更新为 DeepSeek-V4.1-Flash,原生支持多模态(图片理解),图片场景无需再切换到其他模型。
2026-10-01:ecnu-plus 底层模型更新为 Qwen3.8-Flash-Next,响应速度与文本、多模态能力进一步提升。
2026-09-30:新增多模态向量模型 ecnu-embedding-vl 与多模态重排序模型 ecnu-rerank-vl,支持图文混合输入;ecnu-image 新增图像编辑能力,开放接口新增 通用图像编辑。
2026-09-30:峰谷计费时段调整为每天 8:00-18:00 为峰时(国庆假期不执行峰价),ecnu-max 与 ecnu-plus 峰时 credits 消耗仍为 2 倍,详见 配额限制。
2026-09-21:ecnu-plus 的思考强度新增 xhigh 档位,现可选 low / medium / xhigh;ecnu-max 的档位保持 low / high / max 不变,详见 思考模式。
2026-09-18:ecnu-plus 支持通过 reasoning_effort 控制思考强度,可选档位为 low / medium;ecnu-max 的档位为 low / high / max,详见 思考模式。
2026-09-18:ecnu-max 的上下文长度调整为 512K,底层模型保持 DeepSeek-V4-Flash-0731,暂不支持图片理解(图片场景请使用 ecnu-plus)。我们会在算力压力缓解、性能优化改善后,重新部署 DeepSeek-V4.1-Flash。
2026-09-18:单个用户对每个模型的并发请求上限调整为 3(ecnu-max 与 ecnu-plus 分别计算);ecnu-max 与 ecnu-plus 改为峰谷计费,周一至周五 8:00-23:00 为峰时,credits 消耗翻倍。详见 配额限制。
2026-08-31:ecnu-plus 已更新模型为 Qwen3.8-27B。
2026-08-31:ecnu-plus 与 ecnu-max 均支持基于 response_format 的结构化输出,详见 结构化输出。
2026-08-03:ecnu-tts 已更新模型为 Fun-CosyVoice3-0.5B,并新增多种音色,详见 文本转语音。
2026-08-01:ecnu-max 已更新模型为 DeepSeek-V4-Flash-0731。
2026-04-24:ecnu-max 将于 2026-04-27 更新模型为 DeepSeek-V4-Flash,升级后模型能力将有显著提升,但不再支持图片理解能力。如果您的服务依赖于图片理解能力,请尽快切换到 ecnu-plus 或其他支持图片理解的模型。
2026-04-03:对话模型统一收敛为 ecnu-max 和 ecnu-plus 两个主模型,历史模型名称作为兼容别名保留;支持通过 thinking: {"type": "enabled"} 开启思考模式。
2025-03-20: 由于模型架构升级调整,原生的 联网搜索 能力已经下线。如果您的业务依赖 API 接口原生的 联网搜索 能力,请尽快切换到其他方案。