AIDC
DC AI 热点

全部 AI 动态

全部语言仅中文6 条动态
来源筛选
全部来源AITNT · AI头条(网页)Buzzing HN · 中文精选C114 通信网 · AI与算力(网页)DeepSeek 公众号IDC 圈·云与算力(网页)IT168 服务器存储 · AI与算力(网页)IT之家 · AI 筛选InfoQ · 架构与云计算Solidot · AI 筛选少数派 · AI 筛选智谱 公众号月之暗面 Kimi 公众号爱范儿 · AI 筛选腾讯混元 公众号通义实验室 公众号量子位阮一峰 · AI 筛选阶跃 StepFun 公众号AI Roundup · X AI coding圈日报AWS ArchitectureAWS HPCAWS News · 云基础设施AWS 机器学习Anthropic News(RSS)Apple Machine Learning ResearchArs Technica · AI 筛选Azure Blog · 云基础设施CNCF BlogCerebras 官方博客(网页)Claude Code 更新Claude 官方博客(网页)Cloudflare Blog · 网络基础设施Data Center DynamicsData Center KnowledgeEngineering at MetaEquinix Blog · 互联基础设施Gary MarcusGitHub Blog · AI 与安全Google AIGoogle DeepMindGoogle Developers · AI 筛选Google InfrastructureGoogle ResearchHacker News · AIHugging FaceKubernetes BlogLangChain 官方博客(网页)Last Week in AILlamaIndex 官方博客(网页)MIT News · AIMIT Technology Review AIMicrosoft ResearchNVIDIA Developer BlogNVIDIA · AI 筛选Ollama 更新OpenAI 官方动态OpenStack BlogSebastian RaschkaSemiAnalysis · 算力产业ServeTheHomeSimon WillisonTechCrunch AIThe Batch · DeepLearning.AIThe DecoderThe Next PlatformThe Verge · AI 筛选Transformers 更新Transluce 研究(网页)Vertiv 官方新闻arXiv 人工智能arXiv 机器学习arXiv 自然语言处理vLLM 官方博客(网页)vLLM 更新施耐德电气博客
9月29日2026-09-29
TechCrunch AI✦ 精选AI 评分 93/10004:39

AMD将以82亿美元收购李飞飞创立的空间智能公司World Labs

AMD宣布将以82亿美元收购由知名AI学者李飞飞联合创立的空间智能初创公司World Labs。交易完成后,World Labs创始人李飞飞将正式加入AMD,担任执行副总裁兼首席科学家。此举标志着AMD在世界模型与前沿AI软件算法领域进行重大战略布局,旨在抗衡英伟达在全栈AI生态中的主导地位。

阅读原文 ↗推荐理由:82亿美元巨额并购加上顶级学者李飞飞加盟,是芯片巨头向世界模型与软件生态延伸的重磅战略动作。另有 3 家信源报道# AMD# 世界模型# 投融资# 芯片# 计算机视觉
Hacker News · AIAI 评分 62/10002:29

搭载AMD Gorgon Halo芯片的AI迷你主机配备192GB大内存,售价超7000美元

极摩客(GMKtec)推出了新款迷你主机Evo-X5,该设备搭载AMD代号为“Gorgon Halo”(Ryzen AI Max Pro 495)的顶级处理器,并配备了高达192GB的统一内存,主打本地大模型AI运算需求。不过该配置定价极其高昂,售价达到7099美元(早鸟优惠价可减免425美元)。这种配置展示了端侧大内存迷你主机运行百亿参数本地大模型的潜力,但高定价也引发市场关注。

阅读原文 ↗推荐理由:192GB超大内存的AMD APU迷你主机为本地跑大模型提供了新硬件形态,但高昂价格和单一产品预售属性使其重要性有限。另有 1 家信源报道# 端侧AI# 芯片# AMD# 算力
9月26日2026-09-26
ServeTheHome✦ 精选AI 评分 75/10001:00

AMD揭晓下一代EPYC 9006 Venice服务器处理器及Zen 6产品路线图

AMD即将推出下一代代号为“Venice”的EPYC 9006系列服务器处理器,正式将Zen 6微架构引入服务器市场。本次披露涵盖了AMD完整的第六代EPYC产品线布局,并展示了该公司从当下至2027年下半年的服务器与数据中心芯片演进规划,为未来算力基础设施的升级提供支撑。

阅读原文 ↗推荐理由:AMD公开了基于Zen 6架构的下一代EPYC服务器处理器及至2027年的完整产品路线图,对数据中心算力演进具有重要参考价值。# 芯片# 算力# 数据中心# AMD
9月25日2026-09-25
vLLM 官方博客(网页)✦ 精选AI 评分 65/100收录 07:49

在 AMD GPU 上探索 vLLM 投机解码技术

本文主要探讨在 AMD GPU 硬件平台上利用 vLLM 推理框架实现投机解码(Speculative Decoding)的技术探索与优化。投机解码是一种有效降低大语言模型推理延迟的高级加速技术。结合 vLLM 与 AMD 算力生态,旨在提升大模型的生成吞吐量。由于原始素材仅提供标题,具体的实现细节、支持的硬件型号及性能评测数据等信息暂未披露。

阅读原文 ↗推荐理由:关注开源推理框架 vLLM 在 AMD GPU 算力平台上的投机解码实践与性能加速。# AMD# vLLM# 投机解码# GPU算力# 推理
9月23日2026-09-23
vLLM 更新AI 评分 45/10016:06

ROCm CI 新增 AMD MI355 芯片 Dense NVFP4 与 MoRI 算子镜像支持

开源项目在 v0.30.1rc0 版本更新中,针对 AMD ROCm 持续集成(CI)流程添加了下一代加速卡 MI355 的 Dense NVFP4 精度及 MoRI 算子内核镜像。该更新由 AMD 工程师提交,旨在完善对 AMD 新一代硬件低精度计算格式的持续集成测试与底层算子支持,加速相关 AI 框架对 MI355 算力生态的适配。

阅读原文 ↗推荐理由:展示了 AMD 下一代 MI355 算力卡在开源生态与低精度算子层面的适配进展。# AMD# ROCm# MI355# NVFP4# 算力生态
9月14日2026-09-14
vLLM 官方博客(网页)✦ 精选AI 评分 78/10000:00

AMD MI300X实现Megatron训练与vLLM推理的按位完全一致性

vime与RL-Kernel在AMD Instinct MI300X及ROCm软件栈上,实现了Megatron训练端与vLLM推理端(Rollout)选定Token对数概率的按位(bit-for-bit)完全一致。该技术解决了大模型强化学习微调过程中,因训练与采样引擎底层算子实现差异导致的数值偏差痛点,达成测试零误差,大幅提升了AMD算力生态在RLHF等强化学习工作流中的稳定性和可用性。

阅读原文 ↗推荐理由:攻克了大模型强化学习中训练与采样数值不一致的关键系统工程难题,完善了AMD GPU的开源生态。# AMD# 芯片# 算力# 强化学习# 微调