跳转至

平台介绍

第一次使用平台?从新手教程开始 →认识智能体,配置网关与 API Key,完成第一个任务。 继续学习与动手实践词元成长营 ↗阅读实践案例,查找工具指南,分享自己的经验。
平台技术更新

了解模型服务、接口能力与使用方式的更新。

查看技术更新 →
中国科学技术大学 · 大模型公共服务平台

统一、安全的大模型能力入口

面向校内科研、教学与系统开发,平台以 API Key 为核心,提供统一的多模型调用、权限管理与用量控制能力。

288 张高端 AI 加速卡
约 200PFLOPS 算力
统一 API屏蔽底层差异,按需调用多模型能力

平台概述

平台基于国产智能算力与异构 GPU 协同构建高性能算力底座,形成面向大模型推理服务的统一算力体系,为多模型高并发调用提供稳定支撑。

用户无需关注底层硬件与模型部署细节,即可通过标准化接口按需调用模型能力。

算力体系

平台采用 “国产算力 + 异构 GPU” 融合架构,实现高性能与灵活调度的统一。

国产智能算力

  • 910B:面向大规模推理服务,支持高并发模型调用
  • 910C:提供更高性能算力支撑,增强复杂任务处理能力

异构 GPU 算力

  • 提供高性能模型推理能力
  • 支持多类型模型部署,包括通用、推理、长上下文等类型
  • 支撑复杂任务与高负载场景
  • 提升整体算力弹性与调度效率

算力规模

当前平台共部署:

指标 数值
高端 AI 加速卡 288 张
总智能算力 约 200 PFLOPS
估算口径 FP16 非稀疏理论峰值

具备:

  • 大规模并发推理能力
  • 复杂模型计算支撑能力
  • 稳定的多用户服务能力

平台能力

在统一算力调度与模型服务框架下,平台实现以下能力:

能力 说明
异构算力统一调度 支持 GPU / NPU 资源统一纳管,实现算力融合与高效调度
多模型统一服务 提供统一模型接入与标准化 API 调用接口,屏蔽底层差异
高并发推理能力 支持高并发请求处理,保障多用户同时调用的稳定性与响应效率
复杂任务处理能力 支持长上下文、多轮对话及复杂推理任务,满足科研与工程场景需求
安全与权限管理 提供统一身份认证、项目隔离与权限控制机制,保障数据与调用安全

使用方式

平台采用标准化服务模式:

STEP 01用户发起服务访问
→
STEP 02API Key身份与权限凭证
→
STEP 03统一模型网关标准化服务入口
→
STEP 04算力调度GPU / NPU 统一调度
→
STEP 05模型推理服务稳定返回调用结果

用户仅需完成:

  • 申请 API Key
  • 选择模型
  • 发起调用

即可快速使用大模型能力。

使用价值

平台为用户提供:

价值 说明
快速接入 无需部署模型,开箱即用
高性能支撑 支撑高并发与复杂任务
多模型能力 灵活选择适合任务的模型
安全可控 统一认证与权限管理
可管理 支持用量统计与资源控制