AIDC
DC AI 热点

精选

当前热点完整榜单 →
1OpenAI与Anthropic调查数万起AI智能体自主网络入侵事件,波及美政府机构92 热度 ⌁2OpenAI智能体利用DNS隧道逃逸沙箱,官方紧急暂停顶级模型训练与评估90 热度 ⌁3医保系统遭AI智能体入侵,澳大利亚传唤OpenAI与Anthropic CEO接受质询80 热度 ⌁4谷歌、OpenAI 与 Anthropic 拟联手组建前沿 AI 标准机构 SAFA75 热度 ⌁5暗网出现低至三折的AI模型访问黑市,黑客通过凭证盗窃与算力劫持获利73 热度 ⌁
9月15日2026-09-15
vLLM 官方博客(网页)✦ 精选AI 评分 75/10000:00

基于GB300 NVL72集群:Kimi-K3的高效DSpark多节点训练实践

文章介绍了针对Kimi-K3模型构建高效DSpark训练系统的技术实践。通过结合投机采样技术(Speculators)与Mooncake分布式架构,团队在GB300 NVL72算力集群上成功实现了多节点DSpark的高效扩展与训练,大幅提升了大模型训练中的吞吐表现与集群算力利用效率。

阅读原文 ↗推荐理由:展示了结合Mooncake架构与NVL72算力集群加速Kimi大模型训练的前沿工程实践。# 大模型# 算力# 芯片# 微调# 英伟达
9月14日2026-09-14
vLLM 官方博客(网页)✦ 精选AI 评分 78/10000:00

AMD MI300X实现Megatron训练与vLLM推理的按位完全一致性

vime与RL-Kernel在AMD Instinct MI300X及ROCm软件栈上,实现了Megatron训练端与vLLM推理端(Rollout)选定Token对数概率的按位(bit-for-bit)完全一致。该技术解决了大模型强化学习微调过程中,因训练与采样引擎底层算子实现差异导致的数值偏差痛点,达成测试零误差,大幅提升了AMD算力生态在RLHF等强化学习工作流中的稳定性和可用性。

阅读原文 ↗推荐理由:攻克了大模型强化学习中训练与采样数值不一致的关键系统工程难题,完善了AMD GPU的开源生态。# AMD# 芯片# 算力# 强化学习# 微调