首页
产品服务
模型广场
Token工厂
算力市场算力商情行业资讯解决方案有偿资讯商城
注册

AI大模型服务器采购需求公示(2026-JLXLBM-W3012)

招标预告发布日期:2026-09-18
摘要信息
正文内容
摘要信息
招标编码--所属地区--
采购业主--代理机构--
中标机构--截止时间--
正文内容

AI大模型服务器采购需求公示

为便于供应商了解采购信息,根据《物资服务集中采购需求管理暂行办法》等有关规定,现将本项目采购需求公开如下:

一、项目名称

AI大模型服务器采购

二、项目金额

85万元

三、项目概况

支撑AI辅助诊疗、病案内涵质控等医疗AI应用,实现模型本地化部署,数据不出院,满足信创合规要求。

1. 硬件算力平台

1.1 算力服务器

  1. 机架式服务器:4U高度,支持导轨安装。
  2. CPU配置:配置2颗国产CPU(C86或ARM架构),单颗CPU≥64核,基础主频≥2.6GHz,支持硬件虚拟化、算力调度、多任务并行处理,可稳定承载大模型预处理、推理调度业务。
  3. 内存配置:系统内存≥512G,64G DDR5 RECC*8。(内存、CPU、主板选择必须适配)
  4. AI加速卡:配置8张国产AI加速卡,单卡显存≥64GB,显存带宽≥896GB/s。原厂或具备资质的第三方提供 vLLM/SGLang 在该型号加速卡上的 32B 模型实测报告。
  5. 存储配置
    • 配置≥2块SSD系统盘(RAID1),单块硬盘≥960GB;
    • 配置≥6块NVMe SSD数据盘(可配置RAID0/10),单块硬盘≥3.84TB。
  6. 网络配置:≥2个千兆电口 + ≥2个25GE光口。
  7. 电源配置:冗余配置,支持热插拔。
  8. 维保服务:提供≥3年硬件原厂免费维保服务。

2. 大模型与推理平台

2.1 大模型部署

  1. 预置模型:预置2个开源大模型(例如:Qwen2.5-32B、DeepSeek-R1-32B),本地化部署。
  2. 量化与上下文:支持模型INT4/INT8量化部署,支持长上下文。
  3. 模型微调:支持模型微调(LoRA/QLoRA),可利用本院脱敏病历数据进行领域适配。
  4. 推理引擎:支持主流推理引擎(vLLM、SGLang等),具备PagedAttention、连续批处理等显存优化能力。

2.2 知识库与RAG

  1. 知识库管理:内置本地知识库管理系统,支持导入临床指南、药典、医保目录、病案质控标准等文档。
  2. RAG功能:支持文档自动切分、向量化、索引构建及检索增强生成(RAG)。
  3. 版本管理:支持知识库版本管理与更新包导入机制(U盘/内网摆渡),具备签名校验和回滚功能。

2.3 规则引擎

  1. 规则配置:内置确定性规则引擎,支持病案质控规则配置(如性别与诊断矛盾、主诉与诊断不符、必填项缺失等)。
  2. 联动机制:规则与模型输出联动,规则判定结果由大模型生成自然语言质控意见。

3. 实施与服务

3.1 实施要求

  1. 工期要求:合同签订后≤40个自然日内完成到货、部署、调试及验收。
  2. 服务内容:提供模型部署、推理引擎配置、RAG知识库搭建、规则引擎配置。
  3. 培训服务:提供不少于2次现场技术培训,覆盖系统管理员和临床科室用户。

3.2 售后服务

  1. 质保服务:提供≥3年免费质保服务,含硬件保修,大模型、agent、rag平台部署及优化,软件升级,模型更新服务(每半年一次)。
  2. 技术支持:提供7×24小时技术支持热线,故障响应时间≤2小时,现场到达≤24小时。

四、预计采购时间

2026年10月

说明

  1. 本次公开的采购需求公示仅作为供应商了解初步采购安排的参考,采购项目具体情况以最终发布的采购公告和采购文件为准;
  2. 供应商可通过采购平台或联系人反馈参与意见和意见建议。

联系人:杨工
联系电话:13890628920
日期:2026年9月17日

为您推荐
暂无相关推荐
点击立即订阅