docker.io/openguardrails/vllm-glm52-sm80

该镜像基于vllm框架构建,用于GLM-52B大语言模型的高效推理,适配CUDA sm80架构(如NVIDIA A100等显卡),提供优化的运行环境以支持模型的快速部署和高吞吐量推理。

下载:0 版本:1
检测到您正在使用广告拦截插件,本站为公益站点,依赖广告维持运转 🙏 查看如何关闭 ×