-
laibao authored
- 移除 VLLM_USE_MARLIN_W16A16_MOE 环境变量 - 初始化阶段基于 lightop 探测并缓存 _marlin_w16a16_moe_enabled,满足条件强制 use_nn_moe=False - 权重加载后按缓存结果一次性 Marlin pack;运行时按 packed 标记走 Marlin fast path
de588fab
- 移除 VLLM_USE_MARLIN_W16A16_MOE 环境变量 - 初始化阶段基于 lightop 探测并缓存 _marlin_w16a16_moe_enabled,满足条件强制 use_nn_moe=False - 权重加载后按缓存结果一次性 Marlin pack;运行时按 packed 标记走 Marlin fast path