跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

225条精选相关主题模型发布行业动态AI 编码

最新精选

第 141–160 条 · 共 225 条
9月23日周三
  1. AWS News · 云基础设施75

    AWS 推出 Amazon CloudWatch Omni 为生成式 AI 与智能体提供专用可观测性

    AWS 正式推出 Amazon CloudWatch Omni,为生成式 AI 和 AI 智能体工作负载提供跨模型与框架的统一可观测、评估及实验方案。该方案提供 VS Code 与 Kiro 原生 IDE 插件以及独立 Web 界面,内置 17 种评估指标,支持分步追踪 LLM 与工具调用、提示词版本对比及自动化回归测试。IDE 插件免费提供且支持纯本地开发,无需 AWS 账号即可开始使用。

    推荐理由:AWS 将智能体追踪与评估能力内嵌到 IDE 和独立 Web 界面中,让开发者无需登录控制台即可排查非确定性调用问题。

  2. OpenAI 官方动态68

    GPT-6 优化提示词缓存:提升命中率并降低延迟与成本

    OpenAI 介绍了 GPT-6 提示词缓存(prompt caching)的改进机制。该功能通过提高缓存命中率、增加新诊断工具、支持显式断点及控制项,帮助开发者降低模型调用的延迟和成本。

    推荐理由:原文介绍了提示词缓存机制的具体改进方向,读者可以据此评估其对降低调用成本和延迟的作用。

9月22日周二
  1. NVIDIA Developer Blog65

    NVIDIA 发布 DLSS 5 并带来 ACE 与 RTX Kit 多项更新

    NVIDIA 推出 DLSS 5 并引入 3D 导向神经渲染技术,为开发者提供更细粒度的光照与材质控制能力。同时更新还涵盖角色 AI 工具 NVIDIA ACE、RTX Mega Geometry 2.0 以及 RTX Kit,针对高密度几何体与渲染工作流进行了功能扩展。

    推荐理由:原文汇总了神经渲染与角色工具的技术更新,读者可借此了解新特性对画质控制与图形工作流的改变。

  2. 阶跃 StepFun 公众号65

    阶跃星辰 Step 5 Preview 正式上线 TRAE

    阶跃星辰宣布 Step 5 Preview 正式上线豆包旗下 AI 开发工具 TRAE,用户可在全流程开发工作流中直接调用。该模型覆盖 9 类任务与 33 种编程语言,支持代码库理解、跨文件修改、重构与持续数小时的长程任务推进,官方公布其 DeepSWE 得分为 67.7 分,ProgramBench 通过率为 80.5%。

    推荐理由:阶跃星辰将 Step 5 Preview 接入 TRAE 开发环境,并给出了该模型在 33 种编程语言下的代码评测数据。

  3. NVIDIA · AI 筛选71

    NVIDIA 发布 Isaac ROS 5.0,引入智能体工作流与物理 AI 支持

    NVIDIA 在 ROSCon 大会上发布开源软件套件 Isaac ROS 5.0,通过引入智能体工作流帮助开发者与 AI 智能体协同开发机器人应用。新版本增加了对 ROS Lyrical 和 Ubuntu 24.04 的支持,贡献了跨硬件的标准数据处理接口,并提供 FoundationStereo 微调、目标位姿估计模型 FoundationPose 的智能体推理库等技能。

    推荐理由:Isaac ROS 5.0 通过标准化硬件接口和可复用技能,降低了开发者与智能体协同构建机器人感知和抓取工作流的门槛。

  4. vLLM 更新76

    推理框架 vLLM 发布 v0.30.0 版本

    推理框架 vLLM 正式发布 v0.30.0 版本,新增对 DeepSeek-V4.1-Flash、GLM-5.3-Flash 等新架构模型的端到端支持。核心更新引入支持 FP4 与多机 TP 的 Fast Start 显存权重缓存守护进程,大幅缩短引擎重启与初始化耗时;同时上线 HiSparse 分层稀疏 MLA 解码机制,并深度优化了投机解码、上下文并行及 NVFP4 量化性能。

    推荐理由:该版本通过显存权重常驻守护进程与稀疏解码分层卸载,为大模型长上下文与高并发推理提供了可迁移的部署优化方案。

  5. NVIDIA Developer Blog65

    NVIDIA Dynamo-Triton 集成 TensorRT 多设备推理以简化多 GPU 模型服务

    NVIDIA 推出 TensorRT 多设备推理能力并在 Dynamo-Triton 中完成集成,旨在简化多 GPU 场景下的模型服务。该能力基于 NCCL 分布式通信集合,允许单个 TensorRT 网络跨多张 GPU 执行,同时保留 TensorRT 的推理优化性能,已自 TensorRT 11.0 起获得完整支持。

    推荐理由:原文介绍了基于 NCCL 的多 GPU 分布式推理新特性,读者可据此了解 TensorRT 11.0 的多卡部署优化机制。

  6. Engineering at Meta72

    Meta 开源超大规模资源分配求解库 Rebalancer

    Meta 宣布以 Apache 2.0 协议开源已在内部运行超 9 年的高性能分配问题求解库 Rebalancer。该库将问题规范与求解逻辑解耦,支持通过表达式图接入 MIP 求解器或高度并行优化的局部搜索算法,在 Meta 内部每天求解约 4000 万个涉及硬件放置、任务调度及 ML 训练负载均衡的问题。

    推荐理由:Meta 开源了在内部支撑九年超大规模基础设施调度的通用求解库,为海量算力与数据中心资源分配提供了可迁移的高性能解法。

9月21日周一
  1. Hugging Face72

    Hugging Face 发布 tokenizers v1 候选版,编码吞吐提速 3 至 30 倍

    Hugging Face 推出分词库 tokenizers v1 发布候选版,在保持输出 token ID、词表与 API 完全兼容的前提下,单线程编码速度相比 v0.23 提升 3 至 30 倍。

    推荐理由:材料详细拆解了用 SIMD 位流替代正则、内存零分配合并与词缓存等工程设计,为大并发分词系统的性能调优提供了可迁移方案。

9月18日周五
  1. AWS News · 云基础设施64

    Amazon EC2 T8i 突发性能实例正式上线

    AWS 宣布 Amazon EC2 T8i 突发性能实例正式可用,搭载定制第六代 Intel Xeon 可扩展处理器(Granite Rapids),相比上一代 T3 实例性价比最高提升 30%。

    推荐理由:原文给出了 T8i 实例的详细规格与性能对比,开发者可以据此评估低负载工作流向新一代突发实例迁移的性价比。

9月17日周四
  1. 月之暗面 Kimi 公众号70

    Kimi 发布金融行业解决方案

    月之暗面正式推出 Kimi 金融行业解决方案,整合了 10 余个权威数据源、9 项专属金融技能和 5 项合规安全措施。该方案通过 MCP 接入 Wind 万得、东方财富与标普全球等数据源,提供财务建模、研报生成和交互式图表等端到端交付能力,并支持通过 Computer Use 联动本地软件。此外,方案联合中信建投证券共建风险评估网关,通过数据分类分级、授权拦截和责任审计实现合规业务落地。

    推荐理由:方案通过 MCP 接入数据源并封装出九项金融技能,为智能体在强合规与高密度投研场景的落地提供了具体工作流范式。

  2. AWS News · 云基础设施77

    AWS 重塑开发者起步体验:支持第三方登录并适配编码智能体

    AWS 推出面向 AI 开发者的全新简化入门体验,支持使用 Google、GitHub 或 Apple 账号免信用卡直接注册,并提供 100 美元免费额度。系统以项目方式自动隔离权限与成员协作,开发者可直接将配置提示词接入编码智能体,由其自动部署资源并管理底层权限,当业务扩展时可无缝激活完整 AWS 高级功能。

    推荐理由:AWS通过免信用卡登录、自动分配权限以及与编码智能体对接,大幅降低了云端部署基础设施的起步门槛。

  3. Anthropic News(RSS)70

    Anthropic 推出生命科学验证计划 LSVP

    Anthropic 推出生命科学验证计划(LSVP),向通过资质与安全审核的机构开放 Mythos 5.1、Opus 5 和 Sonnet 5 等前沿模型,放宽生物医药领域的安全拦截。

    推荐理由:原文详述了资质审核与离线监控机制,展现了大模型厂商在防范生物滥用风险的同时向合规科研放宽限制的落地路径。

9月16日周三
  1. OpenAI 官方动态68

    OpenAI 推出 AI 广告新体验与赞助智能体

    OpenAI 推出基于 AI 的广告新体验,包含赞助智能体(Sponsored Agents)以及面向营销人员的工具。该体系还提供了与 HubSpot 和 Shopify 的集成支持。

    推荐理由:OpenAI 探索赞助智能体与第三方生态集成,读者可以据此了解其商业化广告与营销工具的新形态。

  2. NVIDIA · AI 筛选78

    NVIDIA 展示 Vera Rubin 与 DSX 平台能效进展,聚焦每兆瓦 Token 产出优化

    NVIDIA 在 AI Infra Summit 上公布了 Vera Rubin 系统与 DSX 平台的最新能效进展,推动 AI 基础设施评估从峰值性能转向每兆瓦有效 Token 产出。

    推荐理由:材料展现了从单卡峰值算力转向每兆瓦可用生成量的指标变化,为评估智算集群的电力与能效经济性提供了参考数据。