跳到正文
原文
Ollama 更新· dhiltgen·· 8 天前AI 评分32

Ollama v0.34.4-rc0 发布:加速 MLX 下 Qwen 3.8 提示词处理

v0.34.4-rc0: mlx: speed up Qwen 3.8 prompt processing (#18550)

AI 导读

Ollama 发布 v0.34.4-rc0 预发布版本,针对 MLX 加速 Qwen 3.8 的提示词处理。该更新在长扫描中引入了 MLX 的 gated-delta kernel,并将稠密 MLP 全局缩放合并至 SwiGLU 结构中。

来源:Ollama 更新 · github.com