APICheck 交流群 · 欢迎加入讨论
QQ 群二维码
群号: 1058136854

使用 QQ 扫一扫上方二维码即可加群

开发无需 API Key

vLLM

高吞吐、显存高效的 LLM 推理与服务引擎

vllm-project GitHub 更新于 2026/07/23
#推理引擎#大模型#高吞吐
0下载
0安装
86,947星标

关于本页数据

本技能包信息最近更新于 2026年7月23日;下载与安装请通过 APICheck 技能资源市场进行, 并以页面展示的版本与来源为准。

vLLM

高吞吐、显存高效的 LLM 推理与服务引擎

vLLM 通过 PagedAttention 等技术实现高吞吐、低显存占用的 LLM 推理与服务,是生产级大模型部署的热门选择。

功能特性

安装

git clone https://github.com/vllm-project/vllm

也可直接访问仓库获取最新代码与文档:https://github.com/vllm-project/vllm

许可证

Apache-2.0