docker.io/malavp/vllm-glm53flash

这是一个基于vllm框架构建的容器镜像,用于快速部署和运行GLM-53Flash大语言模型,支持高效的推理服务,适合需要低延迟、高吞吐量的AI应用场景。

下载:3 版本:1
检测到您正在使用广告拦截插件,本站为公益站点,依赖广告维持运转 🙏 查看如何关闭 ×