平台介绍
平台技术更新
查看技术更新 →了解模型服务、接口能力与使用方式的更新。
中国科学技术大学 · 大模型公共服务平台
统一、安全的大模型能力入口
面向校内科研、教学与系统开发,平台以 API Key 为核心,提供统一的多模型调用、权限管理与用量控制能力。
288 张高端 AI 加速卡
约 200PFLOPS 算力
统一 API屏蔽底层差异,按需调用多模型能力
平台概述
平台基于国产智能算力与异构 GPU 协同构建高性能算力底座,形成面向大模型推理服务的统一算力体系,为多模型高并发调用提供稳定支撑。
用户无需关注底层硬件与模型部署细节,即可通过标准化接口按需调用模型能力。
算力体系
平台采用 “国产算力 + 异构 GPU” 融合架构,实现高性能与灵活调度的统一。
国产智能算力
- 910B:面向大规模推理服务,支持高并发模型调用
- 910C:提供更高性能算力支撑,增强复杂任务处理能力
异构 GPU 算力
- 提供高性能模型推理能力
- 支持多类型模型部署,包括通用、推理、长上下文等类型
- 支撑复杂任务与高负载场景
- 提升整体算力弹性与调度效率
算力规模
当前平台共部署:
| 指标 | 数值 |
|---|---|
| 高端 AI 加速卡 | 288 张 |
| 总智能算力 | 约 200 PFLOPS |
| 估算口径 | FP16 非稀疏理论峰值 |
具备:
- 大规模并发推理能力
- 复杂模型计算支撑能力
- 稳定的多用户服务能力
平台能力
在统一算力调度与模型服务框架下,平台实现以下能力:
| 能力 | 说明 |
|---|---|
| 异构算力统一调度 | 支持 GPU / NPU 资源统一纳管,实现算力融合与高效调度 |
| 多模型统一服务 | 提供统一模型接入与标准化 API 调用接口,屏蔽底层差异 |
| 高并发推理能力 | 支持高并发请求处理,保障多用户同时调用的稳定性与响应效率 |
| 复杂任务处理能力 | 支持长上下文、多轮对话及复杂推理任务,满足科研与工程场景需求 |
| 安全与权限管理 | 提供统一身份认证、项目隔离与权限控制机制,保障数据与调用安全 |
使用方式
平台采用标准化服务模式:
STEP 01用户发起服务访问
→
STEP 02API Key身份与权限凭证
→
STEP 03统一模型网关标准化服务入口
→
STEP 04算力调度GPU / NPU 统一调度
→
STEP 05模型推理服务稳定返回调用结果
用户仅需完成:
- 申请 API Key
- 选择模型
- 发起调用
即可快速使用大模型能力。
使用价值
平台为用户提供:
| 价值 | 说明 |
|---|---|
| 快速接入 | 无需部署模型,开箱即用 |
| 高性能支撑 | 支撑高并发与复杂任务 |
| 多模型能力 | 灵活选择适合任务的模型 |
| 安全可控 | 统一认证与权限管理 |
| 可管理 | 支持用量统计与资源控制 |