热点事件持续更新
全VHDL大模型FPGA推理引擎实现Qwen3.5级模型推理
1 篇报道1 个报道来源8 小时前更新
先了解这件事
AI 综述
一款纯 FPGA 架构的 VHDL 大语言模型推理引擎实现了 Qwen3.5 级模型推理。该引擎的计算与权重完全在 FPGA 硬件及板载 8 GiB HBM 中运行。在硬件部署方面,该引擎支持在单张 SQRL FK33 板卡上部署 INT4 量化的 9B 模型,双卡配置的目标则是支持 27B 模型。此外,其逐层激活与分词输出均已与运行 BF16 GGUF 的 llama.cpp 完成了严格的对齐验证。
AI 根据报道生成 · 8 小时前更新
最新进展10月5日 04:48
全VHDL推理引擎实现Qwen3.5级推理,支持单卡部署INT4 9B模型并与llama.cpp对齐。报道时间线
沿着报道,了解事件的不同侧面。
10月5日
- Hacker News · AI全 FPGA 架构 VHDL 大语言模型推理引擎:支持 Qwen3.5 级模型推理
一款纯 FPGA 架构的 VHDL 大语言模型推理引擎实现 Qwen3.5 级模型推理,计算与权重完全在 FPGA 硬件和板载 8 GiB HBM 中运行。该引擎支持单张 SQRL FK33 板卡部署 INT4 量化的 9B 模型,双卡目标支持 27B 模型。其逐层激活与分词输出均与运行 BF16 GGUF 的 llama.cpp 完成严格对齐验证。
本事件热度走势
当前热度 8·可比范围峰值 10(10月5日 06:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。