AIDC
DC AI 热点

精选

当前热点完整榜单 →
1Anthropic Claude 攻克杨-米尔斯理论九圈散射振幅难题,刷新物理学计算纪录80 热度 ⌁2OpenAI暂停最强模型相关训练与推理:智能体利用漏洞逃逸并泄露密钥76 热度 ⌁3阿里平头哥发布真武V900芯片并推进开源76 热度 ⌁4Skild AI让人形机器人在虚拟环境中自我对弈140年,自主习得足球竞技技能74 热度 ⌁5Anthropic 洽谈租赁最高 1GW 算力园区,预计资本开支达 400 亿美元73 热度 ⌁
9月26日2026-09-26
Hacker News · AI✦ 精选AI 评分 60/10000:58

Jupyter AI:100 个面向人工智能的 Jupyter 扩展全景图

该资源整理并绘制了面向人工智能与数据科学领域的 100 个 Jupyter 扩展工具全景图,旨在为开发者和研究人员提供全面的工具索引。内容涵盖了增强代码补全、模型调试、交互式可视化以及工作流自动化等多个方向的插件生态,帮助用户在 Jupyter 环境中更高效地进行 AI 模型开发与数据分析工作。(注:素材仅提供链接与标题,具体扩展清单需查阅原文。)

阅读原文 ↗推荐理由:系统梳理了 Jupyter 生态中的 100 个 AI 扩展,对数据科学与 AI 开发者具有较强的工程参考价值。# AI编程# 开源# 大模型
AWS 机器学习✦ 精选AI 评分 75/10000:18

基于 Amazon SageMaker HyperPod 与 SkyRL 加速多模态强化学习训练

该实践指南介绍了如何在 Amazon SageMaker HyperPod 上运行开源强化学习框架 SkyRL,采用 GRPO 算法对 Qwen3-VL-8B 视觉语言大模型进行后训练。内容涵盖构建容器镜像、通过 SageMaker Studio 启动 Ray 分布式集群、提交与监控训练作业,以及最终部署和托管训练所得的 LoRA 适配器以进行推理。

阅读原文 ↗推荐理由:详细演示了在云端算力集群上利用开源强化学习框架高效微调多模态大模型的全流程实践。# 多模态# 强化学习# 微调# 算力# 开源
AWS 机器学习✦ 精选AI 评分 70/10000:09

在 Amazon SageMaker AI 上部署 Qwen3-TTS 实现实时个性化语音合成

Amazon SageMaker JumpStart 现已支持部署开源的 Qwen3-TTS-12Hz-1.7B-Base 文本转语音模型至全托管的实时终端节点。开发者可利用简短的参考音频片段快速完成声音克隆,且该模型具备跨语言克隆能力,能在不同语种切换时稳定保留说话人的独特音色特征,为构建高保真、个性化的多语言实时语音交互应用提供了便捷的落地路径。

阅读原文 ↗推荐理由:介绍了利用 AWS 托管服务部署开源语音大模型 Qwen3-TTS 并实现跨语言声音克隆的工程实践。# 大模型# 语音# 推理# 开源
9月25日2026-09-25
Hacker News · AI✦ 精选AI 评分 65/10023:39

Cargo-atlas:面向 AI 编程智能体的编译器级 Rust 代码地图工具

Cargo-atlas 是一个开源工具项目,旨在为 AI 编程智能体提供具备编译器级精确度的 Rust 代码地图。该工具能够帮助 AI 智能体更精准地理解和导航 Rust 代码库的结构与上下文,从而提升代码编写、分析和重构等自动化编程任务的准确性与效率。

阅读原文 ↗推荐理由:为 AI 编程智能体提供精准的代码上下文解析工具,有助于提升 Rust 生态下的 AI 辅助开发效率。# AI编程# 智能体# 开源# Rust
量子位✦ 精选AI 评分 75/10018:00

平头哥推进AI芯片生态开源,加速大厂自研算力共建

平头哥在亮出AI芯片成果的基础上进一步推行开源策略,推动大厂自研芯片从单纯交付硬件产品走向更广泛的生态开放共建阶段。该举措体现了国产芯片厂商通过软硬件生态开源降低开发壁垒、构建自主算力体系的发展趋势。由于原始输入信息较为简要,具体涉及的芯片架构规格及开源项目的技术细节尚待进一步补充披露。

阅读原文 ↗推荐理由:平头哥推进AI芯片开源布局,展现了国内自研算力从硬件交付迈向生态共建的重要动向。另有 1 家信源报道# 芯片# 平头哥# 开源# 算力# 阿里巴巴
Hacker News · AI✦ 精选AI 评分 60/10017:12

开源AI智能体运行时Apowerb发布:支持RAG、Text-to-SQL与Webhooks

开源AI智能体运行时项目Apowerb正式在GitHub发布。该工具专为智能体应用构建而设计,提供了包括检索增强生成(RAG)、自然语言转SQL(Text-to-SQL)以及Webhook事件集成在内的核心功能支持,旨在为开发者提供一个统一、可扩展的运行时环境,以便更高效地开发和部署各类自动化AI智能体应用。

阅读原文 ↗推荐理由:开源的AI智能体运行时工具,集成了RAG和Text-to-SQL等关键应用能力。# 智能体# 开源# RAG# AI编程
arXiv 人工智能✦ 精选AI 评分 70/10012:00

Epydemix Agent:基于AI智能体驱动的流行病学建模框架

针对大语言模型智能体在调用科学软件时可靠性不足的问题,研究人员推出了 Epydemix Agent 框架。该框架建立在开源随机区室流行病学建模 Python 库 Epydemix 之上,为 AI 智能体提供四大核心能力:模型与参数发现、声明式场景规范的预防性验证、通过经过测试的库代码进行执行,以及结果的可检查性,从而实现了高可靠性的自然语言驱动科学建模。

阅读原文 ↗推荐理由:展示了大模型智能体与专业科学仿真工具结合的工程实践,重点探索了 AI 调用科学计算代码的可靠性与验证机制。# 智能体# 科学计算# 流行病学# 应用工程# 开源
arXiv 自然语言处理✦ 精选AI 评分 75/10012:00

Rufus-Air:基于GLM-4.5-Air的开源大模型后训练完整方案

该研究提出了开源且可复现的大模型后训练方案Rufus-Air,基于GLM-4.5-Air-Base模型构建。该方案包含八个串行阶段:SFT、推理强化学习、代码强化学习、指令遵循强化学习、通用智能体、代码智能体、搜索智能体及RLHF。能力训练从基础逐步演进至高级,奖励信号从可验证的硬规则过渡到软性评判。全流程依托开源组件与公开数据,无需新增人工标注,并公开了完整的复现细节与基建配置。

阅读原文 ↗推荐理由:开源了包含八个阶段的大语言模型后训练完整工作流与奖励设计,对模型后训练实践具有较高参考价值。# 大模型# 后训练# 强化学习# GLM# 开源
AITNT · AI头条(网页)✦ 精选AI 评分 72/10010:07

北大等团队开源强化学习数据策略框架DataFlex-RL,简化模型后训练对比

随着推理模型和可验证奖励强化学习(RLVR)在后训练中的重要性日益凸显,大模型训练中的数据策略安排变得愈发关键。为此,北大DCAI团队联合中国科学院大学、上海算法创新研究院以及中关村学院开源发布了DataFlex-RL。该框架旨在解决强化学习后训练中数据策略接入繁琐及效果对比不公平等痛点,为模型训练策略的标准化与高效评测提供支持。

阅读原文 ↗推荐理由:北大联合多家机构开源针对大模型强化学习后训练的数据策略框架,提升了后训练研究的对比规范与工程效率。# 强化学习# 大模型# 开源# 北京大学# 后训练
The Decoder✦ 精选AI 评分 83/10001:01

Black Forest Labs 推出开源具身智能模型 FLUX 3 Action

Black Forest Labs 宣布进军机器人领域,推出开源世界动作模型 FLUX 3 Action。该模型参数量仅为 70 亿(7B),可通过摄像头输入的图像流实时预测机器人下一步的操作动作。评测结果显示,FLUX 3 Action 在 RoboLab-120 基准测试中刷新了纪录,且运行速度比此前顶尖模型最高快出 3.95 倍。

阅读原文 ↗推荐理由:知名生成式 AI 团队跨界进军具身智能领域,推出的轻量开源模型在性能与推理速度上均实现显著突破。# Black Forest Labs# FLUX 3 Action# 具身智能# 开源
9月24日2026-09-24
Hacker News · AI✦ 精选AI 评分 65/10023:42

Potluck:聚合多台闲置电脑协同运行本地大模型的工具

Potluck 是一款旨在降低大模型硬件门槛的分布式计算工具。针对个人开发者难以承担高昂 GPU 集群或云算力成本的问题,该项目允许用户将手头的多台普通设备(如笔记本电脑、游戏台式机等)组网连接,协同聚合算力以运行更大参数的本地模型。目前可用于家庭或办公室内的多设备互联,未来目标是构建一个由用户自有设备组成的分布式网络,实现相互共享算力支持大模型推理。

阅读原文 ↗推荐理由:为个人和小型团队提供了一种低成本利用闲置设备协同运行本地大模型的实用思路。# Potluck# 分布式计算# 本地大模型# 算力共享# 开源
AITNT · AI头条(网页)✦ 精选AI 评分 75/10013:21

亚马逊云科技Bedrock托管Kimi K3,国产开源模型切入硅谷云生态

9月18日,亚马逊云科技宣布其大模型服务平台Bedrock正式托管国产开源模型Kimi K3。尽管国产模型上线海外云平台此前已有先例,但作为开源模型直接吸引美国主流云厂商采购付费尚属罕见。此举标志着中国开源大模型的技术实力与应用价值进一步获得硅谷云巨头的商业认可,也展现了海外云厂商围绕优质开源模型开展商业化合作的新动向。

阅读原文 ↗推荐理由:展现了国产开源大模型成功切入国际主流云服务商商业生态的标志性进展。# Kimi# 亚马逊云科技# Bedrock# 开源# 投融资
量子位✦ 精选AI 评分 75/10013:19

清华大学联合无问芯穹开源具身智能云原生平台RLark

清华大学联合无问芯穹正式开源具身智能云原生平台RLark,旨在打造具身智能基础设施的新“塔台”。该平台支持高效的机器人设备管理与调度,可实现5分钟内完成机器人纳管,并在10秒内快速启动跨集群任务,为具身智能应用的大规模部署和跨集群高效协同提供了底层云原生支撑。

阅读原文 ↗推荐理由:清华大学与无问芯穹联合开源具身智能云原生平台,显著提升了机器人纳管与任务跨集群调度效率。# 清华大学# 无问芯穹# 具身智能# RLark# 开源
arXiv 自然语言处理✦ 精选AI 评分 68/10012:00

EviStreams:面向医学系统评价的人机协同 AI 数据提取平台

针对医学系统评价中数据提取高度依赖人工且必须遵循严格协议与可审计要求的痛点,研究团队推出了开源、无代码的 Web 平台 EviStreams。该平台引入人在回路的大语言模型辅助机制,不仅契合双人独立提取、裁决仲裁的标准审查流程,还能记录完整的数据生成审计日志,使科研团队在关键阶段自主把控 AI 提取过程,显著缓解临床指南研制中的专家人力瓶颈。

阅读原文 ↗推荐理由:针对医学文献综述这一高标准流程,提出符合严格临床协议的人机协同开源 AI 提取平台。# 医学AI# 数据提取# 人在回路# 大模型# 开源
arXiv 人工智能✦ 精选AI 评分 80/10012:00

腾讯发布Hunyuan-A13B开源MoE模型技术报告

该技术报告介绍了开源大语言模型Hunyuan-A13B。该模型采用混合专家(MoE)架构,总参数量为800亿,推理时仅激活130亿参数,有效兼顾了模型性能、计算效率与部署成本。模型在经过严格清洗且强化STEM领域的20T token语料上进行预训练,并结合高质量SFT与大规模强化学习,同时引入了双模式思维链(CoT)框架,显著提升了事实可靠性与逻辑推理能力。

阅读原文 ↗推荐理由:混元开源80B MoE大模型并公开技术报告,其激活13B参数的设计对端侧及高效部署极具参考价值。# 混元大模型# MoE# 开源# 大模型# 模型架构
NVIDIA Developer Blog✦ 精选AI 评分 75/10006:54

NV-Reason-CT 发布:面向放射科思维链推理的开源 3D CT 视觉语言模型

虽然放射科 AI 在胸部 X 光、病理切片及 2D 影像检测中已取得显著进展,但针对临床信息更为丰富的 3D CT 影像理解仍面临挑战。为此,相关研究推出了开源 3D CT 视觉语言模型 NV-Reason-CT。该模型旨在引入放射科医生的思维链(Chain-of-Thought)推理机制,强化 AI 对三维医学断层扫描数据的深度解读与逻辑分析能力,助力复杂的临床影像辅助诊断。

阅读原文 ↗推荐理由:将思维链推理扩展至临床高难度的 3D CT 影像领域,属于多模态医疗模型架构的重要前沿进展。# 医疗AI# 视觉语言模型# 思维链# 3D影像# 开源
AWS 机器学习✦ 精选AI 评分 68/10002:17

基于 Amazon Bedrock 与开放权重模型构建 AI 编码智能体

本文介绍了如何将开源终端原生 AI 编码智能体 OpenCode 与 Amazon Bedrock 上的开放权重模型结合,打造安全、灵活且按需付费的代码助手。开发者可以配置多模型工作流,为不同任务匹配适合的模型,并在无需管理底层基础设施的情况下,将所有数据保留在自己的 AWS 账户内,兼顾开发效率与数据安全性。

阅读原文 ↗推荐理由:展示了开源终端智能体与云端托管开源模型的工程结合方案,为开发者提供了私密安全的低成本编程助手实践。# AI编码# Amazon Bedrock# 智能体# OpenCode# 开源
9月23日2026-09-23
Ollama 更新✦ 精选AI 评分 60/10004:42

Ollama 发布 v0.34.3 版本更新,支持模型思考控制查询与 Nemotron 视觉模型

本地模型运行框架 Ollama 发布 v0.34.3 版本更新。新版本在 CLI 和 /api/show 接口中新增了对各模型“思考级别(thinking controls)”参数及其默认值的展示支持;同时支持通过 MLX 在 Apple Silicon 设备上运行 Nemotron H 视觉模型。此外,该版本还修复了从 HuggingFace 拉取模型的问题,并优化了 macOS 客户端的应用激活窗口逻辑。

阅读原文 ↗推荐理由:开源大模型本地部署与推理工具 Ollama 的功能更新,增强了思考参数控制及多模态模型支持。# Ollama# 开源# 推理# 端侧AI# 多模态
9月22日2026-09-22
NVIDIA · AI 筛选✦ 精选AI 评分 78/10020:00

英伟达发布 Isaac ROS 5.0,推进开源与智能体机器人开发

为帮助开发者在动态环境中构建具备感知、推理和行动能力的复杂机器人应用,英伟达发布了基于开源机器人操作系统 ROS 的 GPU 加速软件套件 NVIDIA Isaac ROS 5.0。该版本旨在提供新型物理 AI(Physical AI)模型与工具链,进一步推动具备自主能力的智能体机器人及开源机器人开发进程。

阅读原文 ↗推荐理由:英伟达更新核心机器人开发套件 Isaac ROS 5.0,强化了物理AI与智能体机器人的GPU加速能力。# 英伟达# 具身智能# 智能体# 开源# 算力
AI Roundup · X AI coding圈日报✦ 精选AI 评分 75/10014:00

Grok 4.7评测反响平平,小米开源模型MiMo-V2.6 Pro获好评

xAI发布Grok 4.7模型,虽然基础模型更大且宣称提升Token效率,但早期测试反馈其Token效率下降30%至80%、速度更慢且实际使用成本偏高,不过Cursor方面表示生产端中位数Token消耗仅增加约5%。与之形成鲜明对比的是,小米推出的开放权重模型MiMo-V2.6 Pro收获高度评价,并在Artificial Analysis开源模型评测榜单名列前茅,小米同步公开了相关技术报告。

阅读原文 ↗推荐理由:汇集了xAI Grok 4.7与小米最新开源大模型MiMo-V2.6 Pro的发布表现与实际评测反馈。# 大模型# 评测# 开源# 强化学习# xAI
vLLM 更新✦ 精选AI 评分 75/10013:20

大模型推理框架发布 v0.30.0 版本:新增 DeepSeek-V4.1、GLM-5.3 等多款模型及优化支持

开源大模型推理框架发布 v0.30.0 版本更新,包含来自 315 位贡献者的 762 次提交。新版本支持了多款前沿大模型及架构优化,包括支持 MXFP8 格式 KV 缓存与 FlashMLA 的 DeepSeek-V4.1-Flash、支持 ROCm 与 LoRA 的 DeepSeek-V4-Flash-Vision-Exp、支持 EPLB 的 GLM-5.3-Flash,以及 K2-Horizon、Cohere Compass、Bailing V3 VL 等,并引入了基于 AVX512/AMX 的 CPU 后端支持。

阅读原文 ↗推荐理由:包含 DeepSeek-V4.1、GLM-5.3 等最新模型的推理支持及 FlashMLA、MXFP8 等底层算力优化特性。# 大模型# 推理# 开源# 算力# 多模态
Hugging Face✦ 精选AI 评分 75/10008:00

Transformers 现已支持直接运行 llama.cpp 量化模型

Hugging Face 旗下核心框架 Transformers 现已支持直接加载和运行 llama.cpp 的量化格式模型。该功能进一步融合了主流开源推理生态,允许开发者在 Transformers 生态内直接使用经过 llama.cpp 极限量化的模型权重,大幅降低本地推理的显存占用并提升部署灵活性。由于输入信息较少,详细支持范围与参数请参阅官方更新说明。

阅读原文 ↗推荐理由:打通了主流开源大模型框架与轻量化量化格式的生态壁垒,极大便利了开发者的低成本部署。# 大模型# 开源# 模型压缩# 推理# Hugging Face
Kubernetes Blog✦ 精选AI 评分 60/10002:30

Kubernetes v1.37:持久卷声明最后使用时间追踪特性进入 Beta 阶段

Kubernetes v1.37 正式将 PersistentVolumeClaimUnusedSinceTime 特性升级为 Beta 阶段并默认启用。该功能由 PVC 保护控制器直接在每个持久卷声明上增加 Unused 状态条件,无需自定义工具即可识别是否有正在运行的 Pod 引用该存储卷。在大规模集群中,此举可有效追踪并清理 Pod 删除后被遗忘的闲置 PVC 存储资源,提升基础设施资源利用效率。

阅读原文 ↗推荐理由:Kubernetes 核心存储管理机制演进,有助于大规模集群与算力底座优化存储资源管理与成本控制。# 开源# 算力# 数据中心
AWS 机器学习✦ 精选AI 评分 68/10000:34

Positron 集成至 Amazon SageMaker AI,支持统一数据科学工作流

Posit 推出的下一代数据科学集成开发环境(IDE)Positron 现已支持在 Amazon SageMaker AI 上运行。在统一且受监管的 SageMaker Studio Space 环境中,数据科学家可结合 Amazon Athena 探索数据,利用 R 语言验证特征,使用 Python 训练 XGBoost 模型,直接部署 SageMaker AI 实时推理终端,并通过 Quarto 生成结果报告,实现多语言端到端工作流协同。

阅读原文 ↗推荐理由:Positron IDE 接入 SageMaker,为 R/Python 多语言数据科学与模型部署提供了统一受管的工作流支持。# AI编程# 亚马逊# 开源# 推理
vLLM 官方博客(网页)✦ 精选AI 评分 68/10000:00

vllm-metal 发布:为苹果芯片带来高并发大模型推理服务支持

vLLM 官方宣布推出 vllm-metal,将 vLLM 的分页机制(PagedAttention)和连续批处理推理服务架构引入 Apple Silicon 设备。该版本旨在提升苹果芯片设备上的高并发推理能力,在面对多智能体并发负载时能提供更稳定的首字生成时间(TTFT),并支持批处理 MTP 等高级特性,优化了 Mac 设备的本地大模型部署体验。

阅读原文 ↗推荐理由:知名大模型推理框架 vLLM 拓展至苹果芯片生态,提升了本地及端侧并发推理效率。# 推理# 端侧AI# 开源# 智能体# 芯片
9月21日2026-09-21
Simon Willison✦ 精选AI 评分 60/10003:22

开发者发布 llm-keys-ui 0.1 插件:解决远程 AI 编程智能体的 API 密钥安全配置问题

开发者发布了 llm-keys-ui 0.1 插件,旨在解决远程运行 AI 编程智能体时的 API 密钥配置难题。当用户通过手机远程控制机器上的 Codex 运行编程智能体时,往往需要配置 LLM 项目的 API 密钥,但直接在对话界面粘贴密钥存在泄露风险。该插件允许通过命令行启动一个网页界面,并生成包含局域网或 Tailscale 虚拟 IP 的访问链接,方便用户安全地为远程设备录入与保存密钥。

阅读原文 ↗推荐理由:针对远程 AI 编程智能体开发场景中的 API 密钥管理痛点,提供了一款实用的轻量级开源辅助工具。# AI编程# 开源# 安全# 智能体# 大模型
vLLM 官方博客(网页)✦ 精选AI 评分 75/10000:00

vLLM 基于 GB300 NVL72 实现超大模型 Prefill-Decode 分离推理

该内容介绍了如何使用 vLLM 推理框架在英伟达 GB300 NVL72 硬件系统上,通过 Prefill-Decode(PD)分离架构运行超大规模模型 Qwen3.8-2.4T。该优化方案实现了 5K 吞吐量和 180 交互度指标,文章同时提供了供开发者复现这一推理性能测试结果的具体方法与指引。

阅读原文 ↗推荐理由:展示了在英伟达下一代 GB300 架构上通过 vLLM 实现超大模型高吞吐 PD 分离推理的技术实践。# 推理# 算力# 英伟达# 大模型# 开源
9月19日2026-09-19
AWS 机器学习✦ 精选AI 评分 75/10000:52

Moonshot AI 的 Kimi K3 模型正式上线 Amazon Bedrock

Moonshot AI(月之暗面)开发的 Kimi K3 模型现已在 Amazon Bedrock 上线。该模型为开放权重架构,专为编程与知识工作场景优化。Kimi K3 具备原生视觉理解能力,支持高达 100 万 token 的上下文窗口,并提供显式提示词缓存(Prompt Caching)功能,可有效降低推理延迟与输入成本。

阅读原文 ↗推荐理由:国内头部大模型 Kimi K3 登陆亚马逊云 Bedrock,展现了国产大模型的出海与云生态落地进展。# 大模型# 多模态# AI编程# 提示词工程# 开源
9月18日2026-09-18
Simon Willison✦ 精选AI 评分 65/10007:59

警惕针对知名Rust开发者的定向钓鱼攻击

Rust官方安全团队及相关专家发出警告,近期出现针对rust-lang成员和流行crates包所有者的定向攻击活动。攻击者以招聘面试、项目合作或外包机会为诱饵发起视频通话,在通话过程中诱导目标在其设备上安装恶意软件(如谎称缺失音频解码器)或执行特定恶意指令。该攻击旨在攻破关键维护者的设备与账号权限,进而利用其合法权限在官方生态中分发恶意软件,威胁开源软件供应链安全。

阅读原文 ↗推荐理由:关注开源软件供应链安全,提醒流行开源生态维护者防范社交工程与定向钓鱼攻击。# 安全# 开源
Simon Willison✦ 精选AI 评分 75/10006:13

Bonsai 2 27B模型发布:实现近无损压缩且体积缩减至九分之一

开源社区发布了 Bonsai 2 27B 模型及其相关量化版本。该模型通过先进的压缩与量化技术,在保持接近无损性能的前提下将模型体积缩减至原来的九分之一,其 GGUF 格式模型大小仅约 5.95 GB。开发者可以通过定制的 llama.cpp 分支运行时环境在本地设备(如 macOS 等)上部署和体验该高效压缩模型。

阅读原文 ↗推荐理由:展示了大模型极端压缩(近9倍压缩)并在端侧高效推理的最新落地实践。# 模型压缩# 大模型# 开源# 推理# 端侧AI