一、清华大学:从高性能计算到“开拓1000”智算系统清华大学高性能计算公共服务平台始于 2005 年清华信息国家实验室,历经“探索3号”“探索100”“探索200”“探索1000”多代系统,向校内外 46 个院系、312 个课题组提供算力服务,支撑用户发表 SCI 论文 1200 余篇(其中 CNS 论文 50 余篇)。 2024 年,平台完成“开拓1000”智算系统建设,有力推动清华人工智能及相关学科发展。 针对国产芯片带来的生态碎片化,清华高性能所研发“九源”智能基础软件栈,已完成与飞腾、鲲鹏处理器及昇腾、寒武纪、昆仑芯等加速芯片,以及麒麟、欧拉等操作系统的适配,方便大模型等智能计算业务开展。 清华类脑计算研究中心还将类脑集群经验延展至“AI 智算超节点集群”,研发 Scale-up 域通信协议、智算超节点交换芯片等,支撑千亿参数模型训练与万亿级推理。 二、中国科学技术大学:校级智算平台三大子平台中科大智算平台(AI Computing Platform)由学校网络信息中心统一建设与运营,是面向科研深度学习与校级 AI 应用的智能计算基础设施,由智算虚拟化平台、大模型公共服务平台、训推一体化平台协同构成统一算力底座。 算力资源覆盖 NVIDIA A100 与华为 Ascend 910B / 910C 等多类型 GPU 集群,支持 PyTorch、TensorFlow、MindSpore、Megatron-LM、DeepSpeed 等框架;其中“大模型公共服务平台”提供校级智能问答、文本生成、OCR/Embedding 等统一模型服务入口,“训推一体化平台”贯通从训练到推理上线的全流程。 此外,依托中科类脑的智能计算平台(类脑智能开放平台)以及先进院信息计算平台,中科大还拥有 12P~32P FLOPS 级、存储达十几 PB 的异构算力,持续服务人工智能与生物医学等研究。 小结清华的“系统+软件栈”与中科大的“校级平台+大模型公共服务”代表了高校智算中心的两种典型范式,既支撑科研,也为国产算力生态与人才培养提供底座。 |