从 Manus 2.0 看 AI 应用演进:赛道向办公、娱乐与个人智能体收敛
Manus 正式发布 2.0 版本,推出 Cascade 架构、面向创作的 Manus Studio 以及主打个人助理的 Cue,并宣布组建团队拓展国内市场。Cue 在创建 Agent 时会为其分配云电脑、支付钱包、邮箱与电话号码,借由聚合多应用上下文切入真实生活服务。
Manus 正式发布 2.0 版本,推出 Cascade 架构、面向创作的 Manus Studio 以及主打个人助理的 Cue,并宣布组建团队拓展国内市场。Cue 在创建 Agent 时会为其分配云电脑、支付钱包、邮箱与电话号码,借由聚合多应用上下文切入真实生活服务。
开源社区发起生成“鹈鹕骑自行车”SVG 动画的测试,以此作为监测大模型状态与能力波动的直观体感工具。分析指出,用户感知的“变笨”不仅关乎模型权重,还叠加了推理强度、上下文管理、工具调度与算力供需紧张等多层工程因素。随着大模型深入长程 Agent 自动化工作流,单步偏差容易沿任务链放大,使得稳定的“智力 SLA”供应成为模型走向实际生产的关键要求。
社区近期掀起利用 Claude Opus 5.5 编写代码直接生成多风格音乐 MV 的热潮,马斯克等多位从业者转发讨论。该玩法并非简单的一键成片,核心流程依赖博主公开的约 9500 字符长提示词,以及配合 Node.js 与 FFmpeg 的自动化生产框架。创作者实践表明,成片质量取决于将动画转为时间函数以支持局部渲染、提前解析音频节拍地图精准卡点,以及通过低清预览多轮迭代优化画面。
RunningHub发布基于MiniMax H3深度后训练的视频增强模型H3 RH Enhanced,生成成本为每秒0.1元。该模型搭载自研长程记忆引擎与五层工程优化,在16镜头以上连续叙事场景中将角色等元素崩坏率降低60%以上,现已登陆MiniMax官网及RunningHub平台开放调用。
Inferact与浪潮信息分别通过TPU巨型算子与超节点超级算子技术大幅提升Kimi K3的推理速度,推动底层算子开发向AI自主优化演进。浪潮信息在元脑SD200 Ultra超节点上利用Kimi K3构建超级算子智能体实现闭环迭代,将综合推理效能提升3倍以上并将Token生成时延压至5.85毫秒。
Vals AI 通过组织10个Claude智能体协作15小时,生成了17895行Lean代码,成功完成了物理数学难题汤姆逊问题N=7的形式化证明。智能体在没有人工介入分工的情况下自主讨论、探索算法并合并代码,将构型空间分区结合精确代数运算,证明了五角双锥构型具有最低能量。该证明已通过Lean内核与独立内核nanoda的双重编译校验。
OpenAI 正式发布干活特化版模型 GPT-6.1 Sol,API 标准价为输入 $2/M tokens、输出 $10/M tokens,仅为 GPT-6 Astra 价格的 20%,缓存读取仅需 $0.10/M tokens。
推荐理由:该模型以 Astra 两成价格和极低的缓存读取成本逼近旗舰表现,为大批量 Agent 工作流提供了极高性价比的落地参考。
Google 针对大学生推出免费使用 1 年 AI 会员的开学季活动,符合条件者可通过官方学生页面申领。美国学生可获得价值约 240 美元的 Google AI Pro,其余 140 多个国家和地区可申领价值约 60 美元的 Google AI Plus,包含更高额度的 Gemini 模型权限、NotebookLM 上限提升及云存储空间。
Anthropic 发布对智谱 GLM-5.3 的网络安全评估报告,指出该模型已具备自主开发端到端漏洞利用程序的能力,但因护栏薄弱且开放权重,显著放大了网络攻击扩散风险。
OpenAI 在 DevDay 发布常驻个人智能体 Dots、协作产品 ChatGPT Space、GPT-6.1 Sol 模型及 Ultrafast 加速档等 25 项更新。
推荐理由:原文汇总了从常驻智能体到云端编码的完整工具链,有助于开发者评估各类能力集成对日常协作与开发流程的实际影响。
前TikTok全球运营负责人周秉俊与胡禹丞创立Lollapalooza,推出AI应用Furever,通过上传照片为离世宠物生成持续更新的图文视频并模拟互动。该产品陆续上线了Memory Wall、Voice Capsules和Companion Mode等功能,构建包含时间与天气变化的虚拟世界。团队还推出了支持长期记忆与桌面提醒的个人助手Furever Dock。
作者分享了结合 AI Agent 进行长途自驾游规划的实操工作流,通过人工确立核心主题与主线、Agent 辅助核对票务规则及对抗性审查,解决一键生成攻略脱离实际的问题。流程涵盖结合小红书点点与一手政策挖掘信息、排查隐藏规则冲突、比选住宿餐饮,并最终导出为离线 HTML 路书。文中还提供了开箱即用的 Agent 旅游规划师初始化提示词。
开发者在 Hacker News 发帖探讨如何在 Codex 与 Claude Code 等 AI 编程智能体触及用量限制时,无缝切换工具且不丢失当前任务上下文。作者指出目前相关迁移工具缺乏实用生态,且因难以承受单 Agent 费用从每月 $20 跃升至 $100-$200,希望向社区寻求低成本的应对方案。
命理工具 Fateshow 融合东西方命理体系,采用先按公开规则生成可逐行核对的排盘、再由 AI 输出行动建议的模式。该产品整合了紫微斗数、八字、西洋占星、人类图以及六爻、奇门遁甲、梅花易数和雷诺曼等多套占卜工具。用户输入出生信息或起卦要素后,AI 可针对职业方向、人际契合度及交易决策等问题提供具体解答。
Blue Cross 保险公司表示,AI 工具已导致产生了近 10 亿美元($1B)的额外成本。该事件涉及路透社报道的相关法律诉讼。
ServeTheHome 分析了 AMD 下一代 EPYC 9006 系列处理器在智能体 AI 时代的数据中心架构定位。该系列采用插槽形态分化策略,包括最高 256 核 512 线程(600W)与 1.6TB/s 内存带宽的旗舰级 SP7 插槽,覆盖 130W 至 400W 的 SP8 插槽,以及配备 1.1GB L3 缓存的高性能计算型号 EPYC 9006X。
DeepSeek 正式开源面向华为昇腾算力平台的基础设施加速组件,涵盖 TileLang 编译工具、DeepGEMM 与 FlashMLA 等高性能算子库以及 DeepEP 分布式通信库。
推荐理由:原文披露了面向昇腾平台的算子库与通信库细节,为在国产算力集群上部署与训练大模型提供了落地参考。
针对前沿实验室利用未公开模型生成数学成果的现状,研究团队基于 600 多份数学界反馈提出了 AI 生成数学成果的发布规范倡议。倡议要求 AI 实验室在公布成果时严格核查文献引用,公开模型名、提示词、思维链与算力成本,并尽可能输出形式化证明 artifacts。此外,倡议要求实验室提供资金支持学术界开展研讨会与消化理解工作,并呼吁向全球数学界提供公平的模型访问权限。
推荐理由:针对 AI 实验室用闭源模型跑数学成果的现状,该倡议系统提出了文献引用、形式化证明与算力成本透明化的发布规范。
太空采矿公司 AstroForge 计划明年发射 Autonomy-1 航天器,利用 AI 测试航天器的完全自主运行能力。该航天器将搭载在 Nova Pathfinder 的首次飞行任务中升空展开测试。
浪潮发布包含四大系列25个方案的智算中心全场景解决方案,其M5系列服务器搭载英特尔傲腾持久内存(PMem)以降低TCO并扩展内存容量。实测显示双路服务器NF5280M5的SQL数据库性能提升近3倍,八路服务器TS860M5内存容量最高达24TB。该方案已落地平安云、短视频推荐、民航运价系统及5G计费等业务场景。
华为在武汉高性能计算大会2022上正式发布鲲鹏高性能计算解决方案,该方案基于鲲鹏全栈打造,涵盖硬件使能、基础软件及应用优化等能力。会上,华为与本地科研机构、高校和企业等16家单位共同启动武汉高性能计算产业联盟,长江欧拉生态创新中心签约揭牌。此外,华中科技大学等8家高校及科研机构的9个团队正式加入鲲鹏科研创新使能计划。
百度沧海·存储推出 BOS、CDS、CFS 和并行文件存储 PFS 等产品,针对传统 HPC、AI HPC 与 HPDA 提供高性能存储方案。方案重点优化数据加载与 Checkpoint 阶段的高吞吐及低延时表现,解决海量小文件元数据瓶颈。系统支持 POSIX 接口、MPI-I/O 框架与 K8s CSI 体系,有效减少算力空转并降低成本。
国际高性能计算和人工智能咨询委员会公布第11届亚太区RDMA编程竞赛结果,西北工业大学队蝉联冠军。南开大学队以及香港中文大学与澳大利亚国立大学联队获得第二名。本次竞赛聚焦大语言模型关键的 Reduce/Scatter 集合通信场景优化,共有20支队伍入选并参与了为期两天的决赛。
在 ISC 2024 公布的最新 Top500 超算榜单中,Intel 与 HPE-Cray 联合打造的 Aurora 以 1.012 exaFLOPS 的 HPL 基准性能位列全球第二,成为全球第二台正式突破百亿亿次的超级计算机。
推荐理由:文章梳理了全球超算与能效榜单格局,有助于读者了解百亿亿次系统的实际落地进展与算力分布变化。
部署于德国尤利希研究中心的百亿亿次级超算 JUPITER 硬件架构与测试数据公开,其在 6 月 Top500 排名中位列第四。该系统主要依赖包含 23,536 颗 GH200 超级芯片的 GPU Booster 模块,在 HPL 基准测试中实现 793.4 PFLOPS 性能与 85.3% 的计算效率,系统能效达每瓦 60 GFLOPS。
推荐理由:文章详细拆解了欧洲百亿亿次级超算 JUPITER 的硬件拓扑与能效数据,为观察大型异构智算集群的架构选型与成本控制提供了参考依据。
中国超算系统灵晟在 ISC2026 公布的 TOP500 榜单中以 2.19EFlops 持续双精度浮点性能登顶。该系统采用无独立 GPU 的全 CPU 架构,自研 LX2 CPU 内部嵌入 AI 矩阵加速单元并集成国产 HBM,配合灵启高速互连网络在千万核心规模下实现 84.4% 的扩展效率。此外,灵晟采用 100% 全液冷散热,能效比达 51GFlops/W,可支撑科学计算与大模型推理等应用。
推荐理由:原文梳理了灵晟超算采用全 CPU 嵌入 AI 矩阵单元的技术路线,展示了自主体系在超智融合算力架构上的工程落地路径。
微软与三星达成合作,计划在德国慕尼黑的微软技术中心组建首套采用 20nm 内存产品的绿色服务器平台。该方案搭载三星 20nm 级 DDR3 内存与 PM830 系列固态硬盘,可将 Windows Server 2008 R2 和 Hyper-V 虚拟机的运行效率提升至两倍,并降低约 50% 的电耗。该平台预计今年第二季度完成组建,未来有望推广至微软全球其他 27 个技术中心。
英特尔计划在面向数据中心的 Haswell-EX 企业级服务器平台上首次整合 DDR4 内存控制器,该平台最多拥有 16 核心、四路 64 核心。DDR4 内存将带来最高 4266MHz 频率、1.2V 低电压以及更优的错误恢复技术。面对 DDR3 价格持续走低与尔必达破产保护的压力,内存厂商寄望借新标准改善盈利,但英特尔推新节奏仍相对谨慎。
Intel计划在企业级服务器平台Haswell-EX上率先整合DDR4内存控制器,带来最高4266MHz频率与1.2V低电压等特性。尽管DDR3价格持续走低导致内存颗粒厂商盈利承压并急盼新标准,但因DDR3市场需求仍处于旺盛期,Intel并不急于切换,颗粒生产企业仍需在艰难中等待新标准普及。
IBM公布其闪存计划,拟投资10亿美元研发闪存技术及一系列固态硬盘系统,推动闪存广泛应用到数据中心。IBM表示闪存单位成本已降至每GB 10美元,与传统硬盘差距大幅缩小,并具备减少占地与冷却、提升性能及降低软硬件成本等优势。该计划还包括在全球各地建立12个数据中心。
以“闪耀IT 存取未来”为主题的2014中国闪存峰会举行,吸引了超过500名行业CIO、IT经理与技术专家参会。来自IBM、戴尔、华为、EMC等领导厂商与研究机构的16位专家发表主题演讲,重点探讨了全闪存阵列、服务器闪存等前沿技术及实际落地经验。此外,移动会议APP易会2.0也在本届峰会完成了首次大规模应用。
Rambus 宣布推出首款 R+ 系列 DDR4 服务器内存芯片组 RB26,主要用于 RDIMM 与 LRDIMM 架构。该芯片组包含寄存时钟驱动器(RCD)与数据缓冲器(DB),完全符合 JEDEC DDR4 2666 Mbps 规范,旨在加速实时分析、虚拟化及内存内计算等数据密集型应用。目前 RB26 样片已面向主要潜在客户及生态系统合作伙伴供货。
新华三通过 3PAR 全闪存系列、UniStor X10000 海量存储以及引入 HPE InfoSight 平台全面布局存储与 AI 运维能力。其中 3PAR 闪存新品性能提升一倍,UniStor X10000 提供 288 节点扩展性且最大支持 50PB 容量。同时,InfoSight 利用 AI 主动预防并解决 90% 以上的问题,实现 6 个 9 可用性,未来将扩展至新华三存储全产品线。
Arm 在 Arm Everywhere China 大会上公布了覆盖边缘、物理世界与云端的全场景 AI 计算底座,推出第二代移动终端计算子系统 CSS for Mobile 2、Neoverse CSS N4、Arm AGI CPU 以及开发者工具 Arm AI Portal。
Arm 在年度大会上发布 Neoverse CSS N4 与 Arm AGI CPU 两款产品,分别面向定制芯片落地与高响应智能体 AI 的量产就绪需求。Arm AGI CPU 具备 300 瓦 TDP 的能效表现,可合规交付中国市场,Arm 借此从纯 IP 授权向兼顾芯片供应转变以拓展数据中心计算生态。
MCV 数值模式依托曙光8000超智融合异构计算架构,用不到 1 小时完成全球 5 公里分辨率、未来 10 天预报计算,实现全球公里级预报计算时效达标。该成果由中国气象局地球系统数值预报中心与中科曙光联合完成,通过软硬件协同优化使存储读写效率提升约 30 倍,并已进一步开展全球 3 公里分辨率模拟试验。
华为坤灵全面升级“4+10+N”一站式场景化方案并发布20款新品,同时面向中国分销伙伴推出“经纬计划”和50个样板点。该方案围绕智能办公、商业、教育和医疗四大核心场景,推出网络安防融合一体机AR281、数字诊疗IT平台及具备智能装维能力的小灵智能体等产品。“经纬计划”将联动1.5万多家工程商伙伴,构建覆盖全国300个城市的销售与服务网络。
华为在全联接大会2026上发布业界首款采用NPO光互联技术的昇腾960超节点、7.2T传输容量的Hi-ONE光互联引擎以及OceanStor M900 KV缓存集群。
推荐理由:原文披露了昇腾960超节点与NPO光互联架构细节,展示了面向百万卡AI集群从总线协议到多层缓存的系统级工程方案。
华为在全联接大会发布全球首个采用NPO技术的昇腾960超节点,以及总容量达7.2T的NPO光引擎Hi-ONE。昇腾960超节点采用正交架构与全液冷设计,基于灵衢总线实现内存统一编址,单超节点可扩展至4096卡规模,算力达8EFLOPS FP8与16EFLOPS FP4,最大可构建100万卡超节点集群。
推荐理由:原文披露了NPO光互连与超节点全液冷架构的具体参数,读者可据此了解大规模AI集群的硬件演进路径。
神州鲲泰正式推出基于鲲鹏950和昇腾950DT的新一代算力产品矩阵,包括KunTai R722 K3通用服务器以及KunTai PoD2000 A5液冷超节点、KunTai A989 I5风冷超节点和标准服务器。
推荐理由:新品矩阵覆盖了风冷与液冷等不同部署场景,读者可据此评估存量机房与新建智算中心的国产化算力落地路径。