AIDC
DC AI 热点

精选

当前热点完整榜单 →
1Anthropic Claude 攻克杨-米尔斯理论九圈散射振幅难题,刷新物理学计算纪录83 热度 ⌁2OpenAI暂停最强模型相关训练与推理:智能体利用漏洞逃逸并泄露密钥79 热度 ⌁3阿里平头哥发布真武V900芯片并推进开源78 热度 ⌁4Skild AI让人形机器人在虚拟环境中自我对弈140年,自主习得足球竞技技能76 热度 ⌁5Anthropic 洽谈租赁最高 1GW 算力园区,预计资本开支达 400 亿美元75 热度 ⌁
9月26日2026-09-26
AWS 机器学习✦ 精选AI 评分 75/10000:29

基于 Amazon EKS、EFA 与 DeepEP 扩展 MoE 强化学习,吞吐量提升 40%

文章介绍了如何在 Amazon EKS 上利用 Elastic Fabric Adapter (EFA) 和 DeepEP 扩展混合专家模型(MoE)的强化学习训练。该方案构建了结合 Amazon EKS、EFA 与 Amazon S3 的技术架构,有效针对大规模 RLHF 与 GRPO 训练场景,将整体强化学习 rollout 阶段的吞吐量提升了 40%,优化了分布式集群的通信与计算效率。

阅读原文 ↗推荐理由:展示了结合 AWS 高性能网络组件与 DeepEP 加速 MoE 模型大规模强化学习训练的工程实践架构。# 强化学习# 大模型# 算力# Amazon# 微调
AWS 机器学习✦ 精选AI 评分 68/10000:15

NarrateAI在Amazon Bedrock上实现生产级大模型质量保证方案

NarrateAI展示了基于Amazon Bedrock构建生产就绪的大语言模型质量保证(QA)体系。该方案详细介绍了五项核心技术:自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估以及数据准确性验证。通过这些技术组合,系统在保障实时流式响应输出的同时,使数值准确率达到了约99%,为大模型生产落地提供了高可靠的质检参考。

阅读原文 ↗推荐理由:介绍了在云端生产环境中保障大模型输出质量与实时评估的五项工程化技术。# 大模型# 评测# 推理# Amazon Bedrock
AWS 机器学习✦ 精选AI 评分 70/10000:09

在 Amazon SageMaker AI 上部署 Qwen3-TTS 实现实时个性化语音合成

Amazon SageMaker JumpStart 现已支持部署开源的 Qwen3-TTS-12Hz-1.7B-Base 文本转语音模型至全托管的实时终端节点。开发者可利用简短的参考音频片段快速完成声音克隆,且该模型具备跨语言克隆能力,能在不同语种切换时稳定保留说话人的独特音色特征,为构建高保真、个性化的多语言实时语音交互应用提供了便捷的落地路径。

阅读原文 ↗推荐理由:介绍了利用 AWS 托管服务部署开源语音大模型 Qwen3-TTS 并实现跨语言声音克隆的工程实践。# 大模型# 语音# 推理# 开源
9月25日2026-09-25
AWS 机器学习✦ 精选AI 评分 72/10023:49

基于 Amazon SageMaker HyperPod 与 Qumulo 实现跨区域大模型训练

该方案结合 Amazon SageMaker HyperPod 与云原生存储 Qumulo,支持将模型训练算力集群与数据集部署在不同的 AWS 区域。测试验证结果显示,通过利用 NeuralCache 进行短暂预热后,跨地域远程计算集群的训练数据吞吐量能够达到与本地同地域集群相同的性能水平,有效解决了跨区域算力调度与数据访问的瓶颈。

阅读原文 ↗推荐理由:展示了解决跨区域算力与数据集分离痛点的高效大模型分布式训练架构与实测性能。# 算力# 大模型# 数据中心# Amazon
9月23日2026-09-23
AWS 机器学习✦ 精选AI 评分 65/10002:10

GPT-6 Sol 与 GPT-6 Luna 正式上线 Amazon Bedrock

GPT-6 Sol 与 GPT-6 Luna 模型现已在 Amazon Bedrock 平台正式全面可用(GA)。这两款新模型的引入,旨在帮助开发者和企业用户根据不同业务工作负载的具体需求,更灵活地在智能水平与运行效率之间进行权衡和匹配,从而为日常工作流及各类生产力场景提供更多样化的生成式 AI 模型选择。

阅读原文 ↗推荐理由:Amazon Bedrock 正式上线新模型,丰富了云端大模型部署与工作流调用的生态选择。# 大模型# 推理# Amazon
AWS 机器学习✦ 精选AI 评分 75/10001:28

Anthropic 旗舰大模型 Claude Opus 5.5 正式上线 AWS

Anthropic 旗下性能最强的大模型 Claude Opus 5.5 现已在 Amazon Bedrock 以及 AWS 上的 Claude Platform 正式上线。该模型专为智能体编程、复杂知识工作和长周期任务设计。开发者目前可以通过 Amazon Bedrock 快速接入并构建基于 Opus 5.5 的企业级 AI 应用。

阅读原文 ↗推荐理由:Anthropic 顶级旗舰模型在主要公有云平台上线,对企业级智能体和开发生态影响显著。# Anthropic# 大模型# 智能体# AI编程# AWS
9月22日2026-09-22
AWS 机器学习✦ 精选AI 评分 65/10023:46

Reactiv利用Amazon Bedrock构建多智能体系统,提升移动电商自动化效率80%

移动电商平台Reactiv基于Amazon Bedrock AgentCore开发了多智能体AI调度器(AI Scheduler)。该系统能够按照设定计划自主刷新Shopify商家的移动端应用程序内容与配置。这一应用帮助商家减少了80%的配置耗时,并使产品投产上线速度提升了33%,展示了多智能体技术在电商运维自动化中的实际落地价值。

阅读原文 ↗推荐理由:展示了利用Amazon Bedrock多智能体架构实现移动电商自动化运营的具体落地案例。# 智能体# AWS# 大模型
AWS 机器学习✦ 精选AI 评分 70/10023:35

利用 Amazon SageMaker AI 并发扫描功能优化生成式 AI 端点算力配置

Amazon SageMaker AI 推出并发扫描功能,帮助用户在不同负载水平下系统性基准测试生成式 AI 端点,以实现算力资源的合理配置(Right-sizing)。文章详细介绍了模型部署流程,以及如何利用 CreateAIBenchmarkJob API 运行自动化并发测试,并根据测试结果在算力集群规模(Fleet Size)和容量规划上做出基于数据的决策。

阅读原文 ↗推荐理由:介绍了在 AWS SageMaker 上利用自动化并发基准测试优化大模型推理端点算力配置的实用工程方法。# 大模型# 推理# 评测# 算力# AWS
AWS 机器学习✦ 精选AI 评分 75/10002:30

xAI旗下Grok 4.6正式上线Amazon Bedrock平台

xAI的前沿模型Grok 4.6现已正式登陆Amazon Bedrock平台。该模型专为长时间运行的智能体、编程和知识型工作设计,配备500K token的超长上下文窗口,并提供四个推理努力等级。用户可通过bedrock-mantle和bedrock-runtime端点调用,并获得Converse API及跨区域推理功能支持。

阅读原文 ↗推荐理由:xAI核心模型接入主流云服务商AWS Bedrock,标志着其商业化与生态分发进一步拓展。# xAI# 大模型# 智能体# 推理# AI编程
AWS 机器学习✦ 精选AI 评分 70/10000:24

EXL基于AWS推出医疗智能文档处理方案,大幅缩减理赔审核时间

EXL在AWS上构建了AI医疗智能文档处理(IDP)解决方案。该方案结合了Amazon SageMaker和Amazon Bedrock上的领域专属大语言模型,能够在企业级规模下高效提取、总结和查询医疗记录。该应用旨在解决传统医疗理赔审查耗时长的问题,将原本每例超过100分钟的审查时间显著缩短,提升业务处理效率。

阅读原文 ↗推荐理由:展示了大模型与智能文档处理结合在医疗理赔场景中的企业级落地方案与降本增效效果。# 医疗AI# 大模型# AWS# 自然语言处理
9月19日2026-09-19
AWS 机器学习✦ 精选AI 评分 75/10004:52

亚马逊云科技回顾 SageMaker AI 2026 年多项推理功能更新

亚马逊云科技(AWS)汇总了 Amazon SageMaker AI 在 2026 年初至今推出的 13 项推理相关更新,涵盖全托管端点与 Amazon SageMaker HyperPod Inference 两大部署路径。重点功能包括推理配置推荐、容量感知实例池、分层 KV 缓存机制,以及预填充与解码解耦(disaggregated prefill and decode)等大模型推理优化技术,旨在提升云端 AI 部署效率并降低算力成本。

阅读原文 ↗推荐理由:系统盘点了 AWS SageMaker 在大模型推理加速与算力资源池化管理方面的前沿落地特性。# Amazon# 推理# 算力# 大模型
AWS 机器学习✦ 精选AI 评分 75/10000:52

Moonshot AI 的 Kimi K3 模型正式上线 Amazon Bedrock

Moonshot AI(月之暗面)开发的 Kimi K3 模型现已在 Amazon Bedrock 上线。该模型为开放权重架构,专为编程与知识工作场景优化。Kimi K3 具备原生视觉理解能力,支持高达 100 万 token 的上下文窗口,并提供显式提示词缓存(Prompt Caching)功能,可有效降低推理延迟与输入成本。

阅读原文 ↗推荐理由:国内头部大模型 Kimi K3 登陆亚马逊云 Bedrock,展现了国产大模型的出海与云生态落地进展。# 大模型# 多模态# AI编程# 提示词工程# 开源