ghcr.io/chenyb999-zhcn/1cat-vllm

该镜像基于vLLM构建,用于快速部署大语言模型推理服务,支持高效的token生成,具备低延迟、高吞吐量的特性,适用于需要大规模语言模型推理的场景。

下载:0 版本:1
检测到您正在使用广告拦截插件,本站为公益站点,依赖广告维持运转 🙏 查看如何关闭 ×