AI大模型服务器采购需求公示
为便于供应商了解采购信息,根据《物资服务集中采购需求管理暂行办法》等有关规定,现将本项目采购需求公开如下:
一、项目名称
AI大模型服务器采购
二、项目金额
85万元
三、项目概况
支撑AI辅助诊疗、病案内涵质控等医疗AI应用,实现模型本地化部署,数据不出院,满足信创合规要求。
1. 硬件算力平台
1.1 算力服务器
- 机架式服务器:4U高度,支持导轨安装。
- CPU配置:配置2颗国产CPU(C86或ARM架构),单颗CPU≥64核,基础主频≥2.6GHz,支持硬件虚拟化、算力调度、多任务并行处理,可稳定承载大模型预处理、推理调度业务。
- 内存配置:系统内存≥512G,64G DDR5 RECC*8。(内存、CPU、主板选择必须适配)
- AI加速卡:配置8张国产AI加速卡,单卡显存≥64GB,显存带宽≥896GB/s。原厂或具备资质的第三方提供 vLLM/SGLang 在该型号加速卡上的 32B 模型实测报告。
- 存储配置:
- 配置≥2块SSD系统盘(RAID1),单块硬盘≥960GB;
- 配置≥6块NVMe SSD数据盘(可配置RAID0/10),单块硬盘≥3.84TB。
- 网络配置:≥2个千兆电口 + ≥2个25GE光口。
- 电源配置:冗余配置,支持热插拔。
- 维保服务:提供≥3年硬件原厂免费维保服务。
2. 大模型与推理平台
2.1 大模型部署
- 预置模型:预置2个开源大模型(例如:Qwen2.5-32B、DeepSeek-R1-32B),本地化部署。
- 量化与上下文:支持模型INT4/INT8量化部署,支持长上下文。
- 模型微调:支持模型微调(LoRA/QLoRA),可利用本院脱敏病历数据进行领域适配。
- 推理引擎:支持主流推理引擎(vLLM、SGLang等),具备PagedAttention、连续批处理等显存优化能力。
2.2 知识库与RAG
- 知识库管理:内置本地知识库管理系统,支持导入临床指南、药典、医保目录、病案质控标准等文档。
- RAG功能:支持文档自动切分、向量化、索引构建及检索增强生成(RAG)。
- 版本管理:支持知识库版本管理与更新包导入机制(U盘/内网摆渡),具备签名校验和回滚功能。
2.3 规则引擎
- 规则配置:内置确定性规则引擎,支持病案质控规则配置(如性别与诊断矛盾、主诉与诊断不符、必填项缺失等)。
- 联动机制:规则与模型输出联动,规则判定结果由大模型生成自然语言质控意见。
3. 实施与服务
3.1 实施要求
- 工期要求:合同签订后≤40个自然日内完成到货、部署、调试及验收。
- 服务内容:提供模型部署、推理引擎配置、RAG知识库搭建、规则引擎配置。
- 培训服务:提供不少于2次现场技术培训,覆盖系统管理员和临床科室用户。
3.2 售后服务
- 质保服务:提供≥3年免费质保服务,含硬件保修,大模型、agent、rag平台部署及优化,软件升级,模型更新服务(每半年一次)。
- 技术支持:提供7×24小时技术支持热线,故障响应时间≤2小时,现场到达≤24小时。
四、预计采购时间
2026年10月
说明
- 本次公开的采购需求公示仅作为供应商了解初步采购安排的参考,采购项目具体情况以最终发布的采购公告和采购文件为准;
- 供应商可通过采购平台或联系人反馈参与意见和意见建议。
联系人:杨工
联系电话:13890628920
日期:2026年9月17日