RunningHub 发布生成式视频超分模型 RH Upscale
海马云旗下 RunningHub 正式发布自研生成式视频超分模型 RH Upscale,主打在放大与纹理恢复的同时保持人物、构图及运动一致性,在 13 组横评中 Ultra 档位以 0.539 综合得分位列第一。
海马云旗下 RunningHub 正式发布自研生成式视频超分模型 RH Upscale,主打在放大与纹理恢复的同时保持人物、构图及运动一致性,在 13 组横评中 Ultra 档位以 0.539 综合得分位列第一。
至知创新研究院开源了 320B 稀疏 MoE 大模型 IQuest-Q1,并公开了权重与技术博客。该模型在训练中采用了多教师在线策略蒸馏(MOPD)技术,不仅在研发过程中自主排查并修复了因空格导致的训练停滞问题,还在交通绿波控制、电商仓库 AGV 调度、写字楼电梯派梯及纯代码前端生成等复杂长程任务中完成实测验证。相关权重与代码已在 GitHub 与 Hugging Face 同步开源。
Liquid AI 推出专用于结构化决策的决策模型 D1,无需逐 token 生成文本,可在单次 API 调用中直接返回校准后的概率分布,output_tokens 始终为 0。
推荐理由:原文给出了不生成文本的概率决策机制和三种原语,读者可以据此评估在分类与路由场景中替代传统生成式大模型的可行性。
德塔智能发布双足人形机器人基础模型 Delta 0,支持全身 69 个自由度统一控制并能自主连贯完成长程复杂家务。该模型采用大小脑分层架构,大脑基于隐式世界动作模型进行预测与规划,小脑通过纯算法力位混合控制实现关节微操与借力。在零样本测试中,Delta 0 的全局与身体位置误差均低于英伟达 SONIC 等对比控制器。
RunningHub发布基于MiniMax H3深度后训练的视频增强模型H3 RH Enhanced,生成成本为每秒0.1元。该模型搭载自研长程记忆引擎与五层工程优化,在16镜头以上连续叙事场景中将角色等元素崩坏率降低60%以上,现已登陆MiniMax官网及RunningHub平台开放调用。
OpenAI 正式发布干活特化版模型 GPT-6.1 Sol,API 标准价为输入 $2/M tokens、输出 $10/M tokens,仅为 GPT-6 Astra 价格的 20%,缓存读取仅需 $0.10/M tokens。
推荐理由:该模型以 Astra 两成价格和极低的缓存读取成本逼近旗舰表现,为大批量 Agent 工作流提供了极高性价比的落地参考。
开源决策模型 Jeff 正式发布,基于 Qwen3.5-0.8B/2B 与 Gemma 4 E2B 微调,支持单次前向推理直接输出校准概率,单次决策延迟低至 22 至 28 毫秒。
推荐理由:原文展示了仅需单次前向推理的轻量级决策模型实现路径,为端侧与高并发场景下的极速分类与路由提供了低成本方案。
PostHog 开源决策分类模型 Jeeves,基于 Qwen3.5-9B 结合 LoRA、指针头与 CISPO 强化学习训练,使分类器在输出最终决策前展开链式推理。
上海人工智能实验室开源多模态决策模型 Intern-Decision,推出 0.8B、2B 与 4B 三款规格并开放权重与代码。在单张 RTX 4090 上,该模型推理速度较 Jev 提升 2-3 倍,4B 模型时延低于 45ms,0.8B 和 2B 版本达到每秒约 30 次推理。模型支持直接读取画面完成游戏与浏览器操作,并可通过温度校准和置信度机制与大模型协同工作。
至知创新研究院开源了稀疏 MoE 架构大模型 IQuest-Q1,总参数约 320B、激活参数约 15B,主打代码生成、软件工程与长程复杂任务执行。该模型在预训练、中期训练和后训练三阶段中采用了多教师同策略蒸馏(MOPD)方法,并在 NL2Repo、Terminal-Bench 2.1 与 DeepSWE v1.1 等基准上展示了较为均衡的能力。
中国电信星辰通用人工智能实验室推出并开源约 1.2B 参数的文档解析模型 TeleOCR,相关资源已上线 GitHub 与 Hugging Face。该模型采用形变感知学习与内容-结构解耦设计,通过动态多边形与曲率引导采样算法处理拍摄弯曲与透视,支持复杂表格与 19 种科学图表提取。
可灵 AI 推出 Kling 4.0 视频生成模型及兼顾速度与性价比的 Kling 4.0 Flash,在画面真实感、长镜头叙事与专业控制上实现升级。模型支持 10-bit HDR 及 4K/1080P 输出、单次原生最长 30 秒生成,覆盖 9 种语言口型同步,并支持单次任务组合最多 15 项参考素材与 10 张关键帧。
推荐理由:原文实测了新模型在运镜稳定性、10-bit HDR 输出与多参考控制上的表现,便于创作者评估其接入专业影视流程的实用性。
OpenAI 联合 Cerebras 推出专为实时软件开发设计的 GPT-5.3-Codex-Spark 模型研究预览版,由 Cerebras 晶圆级引擎(Wafer-Scale Engine)驱动,推理速度超过 1,000 tokens/s。
推荐理由:该模型通过晶圆级芯片实现超 1000 tokens/s 推理速度,展示了定制硬件对实时交互式编程工作流的加速效果。
Anthropic 正式发布 Claude Opus 5.5,其在多数任务中达到 Claude Fable 5.1 的性能水平,运行成本较 Opus 5 降低 40%。此外,Anthropic 威胁情报团队发布 2026 年 9 月安全报告,披露了过去 8 个月内识别并处置的恶意使用 Claude 案例与威胁演变。
ElevenLabs 正式发布文本转语音模型 Eleven v4 及其低延迟版本 Eleven v4 Turbo,采用全新架构以提升语调、节奏与情绪表现力。模型支持通过自然语言提示词及行内标签精细控制情绪和音效,并覆盖超过 90 种语言的多语种克隆;Eleven v4 Turbo 中位推理延迟约 100ms、首字发音中位时间约 150ms,重点面向实时对话智能体场景。
推荐理由:新模型在保留音色一致性的基础上强化了多角色对话情绪表达,为实时语音智能体提供了低延迟参考方案。
ElevenLabs 正式发布 Eleven v4 语音模型及面向实时语音智能体的 Turbo 版本,能更精准地遵从笑声、耳语等脚本情绪与音效指令。新模型支持超过 90 种语言,单次请求最高支持 10,000 字符,发音基准得分提升至 91.7%,Turbo 版本响应延迟低至约 150 毫秒。两款模型现已上线 API、ElevenAgents 和 ElevenCreative,并推出限时折扣。
推荐理由:新架构提升了长文本一致性与情感指令遵从度,配合 150 毫秒低延迟的 Turbo 版本,适合兼顾表现力与实时交互的语音场景。
OpenAI 在 DevDay 活动上正式发布 GPT-6.1 Sol 模型,称其在智能体编码、计算机操作及专业工作上的智能水平接近 GPT-6 Astra,而标准输入与输出 token 价格仅为后者的五分之一。
推荐理由:新模型以五分之一的价格提供接近旗舰模型的智能水平,并改进了低推理强度下的事实准确率与安全遵从度。
Anthropic 正式推出 Claude Haiku 4.5,在编码、电脑使用及智能体任务上达到 Sonnet 4 水平,并在 SWE-bench Verified 基准测试中取得 73.3% 的成绩。
推荐理由:原文对比了该轻量模型与旗舰版本的编码和推理表现,读者可以据此评估多智能体协作与大规模调用的性价比边界。
Anthropic 正式推出 Claude Sonnet 5.5 混合推理模型,具备 1M 上下文窗口,运行速度相比 Sonnet 5 提升 30% 且典型工作流成本降低最高达 30%。
推荐理由:官方公布了新模型的定价与多场景实测数据,开发者可以据此评估高频编码与 Agent 任务的替换成本。
Anthropic 正式推出混合推理模型 Claude Opus 5.5,具备 1M 上下文窗口,在典型工作负载下的运行成本较 Opus 5 降低约 40%。
推荐理由:该模型在保持前沿智能的同时大幅压缩了长程智能体与复杂代码任务的步数与运行成本。
Anthropic 正式发布 Claude Fable 5.1 大语言模型,主打长周期、异步及跨应用的复杂编码与深度知识工作。模型 API 定价为输入每百万 token 10 美元、输出每百万 token 50 美元,缓存读取费用降至每百万 token 0.25 美元,已面向订阅用户及主要云平台开放。
推荐理由:原文详细说明了新模型的定价变化、降本幅度与安全路由机制,有助于评估复杂长周期任务的迁移成本。
Anthropic 推出新一代 Mythos 级别模型 Claude Mythos 5.1,在网络安全和生物学研究能力上取得提升,目前仅通过受信任准入计划向审核通过的机构开放。
推荐理由:Anthropic 推出专精网络安全与生物研究的高能力模型并配套安全受控版本,展示了前沿高危 AI 能力在受限准入下的分级部署路径。
Anthropic 正式推出 Claude Sonnet 5.5,在 Terminal-Bench 4.0 代码测试中取得 70.6% 的成绩,表现逼近旗舰 Opus 5.5。
推荐理由:材料汇总了新模型在代码评测、工程验证以及单任务实际调用成本上的具体测试数据,便于评估中端模型的替代可行性。
可灵AI宣布最新一代旗舰视频生成模型 Kling 4.0 开启内测并计划于10月上线,同时推出轻量版 Kling 4.0 Flash。Kling 4.0 单次原生生成时长达到30秒,结合续拍最长可达2分钟,支持最多10张关键帧与15个参考素材输入,并新增双通道立体声、21:9超宽画幅与10-bit HDR高规格输出。
推荐理由:新版本将原生生成时长提升至30秒并支持10张关键帧控制,反映出视频生成正从短片段生成转向长镜头与专业叙事流程。
代季峰创办的 Naive AI 开源了首款面向编程与 AI 研发的大模型 Naive-N0.5-Flash,总参数量 309B,激活参数量 15.5B,原生支持 1M 上下文。
OpenAI在DevDay 2026发布了新模型GPT-6.1 Sol以及常驻智能体Dots等25项更新。GPT-6.1 Sol重点加强智能体编程和电脑操作能力,标准API价格为每百万Token输入2美元、输出10美元,仅为旗舰Astra的五分之一。
推荐理由:材料汇总了OpenAI在新模型和Agent环境上的多项更新,读者可以借此了解低成本模型与常驻智能体配合落地的产品路径。
GPT 6.1 Sol 具备接近 Astra 的智能水平,而价格仅为后者的五分之一。该动态由 Simon Willison 于 9 月 29 日记录并发布。
OpenAI 推出新模型 GPT-6.1 Sol,在旗舰模型 GPT-6.1 Astra 因安全顾虑延期之际,以约五分之一的成本提供接近后者的 Agent 编码与办公能力。
推荐理由:在旗舰模型 Astra 因安全顾虑推迟发布的背景下,Sol 以更低成本提供接近的表现,便于开发者权衡 Agent 任务的落地性价比。
NVIDIA 正式开源表格基础模型 Kumo Tabular,支持在无需训练、微调或特征工程的前提下,通过单次前向传播直接完成表格数据的分类与回归预测。该模型包含 28M 到 215M 三种参数规模,完全基于结构因果模型生成的合成数据完成预训练,并在 TabArena、BeyondArena、TALENT 与 ScoringBench 四项基准测试中均位居榜首。
推荐理由:模型展示了完全依赖因果合成数据预训练表格大模型的可行路径,读者可以借此了解免微调与零特征工程在表格预测任务中的落地机制。
OpenAI 推出 GPT-6.1 Sol 模型,在编程、计算机使用(computer use)与专业工作任务中提供接近 Astra 的智能水平。该模型的标准 API 输入和输出 token 价格为 Astra 的五分之一。
推荐理由:原文对比了该模型在编程与计算机操作中接近 Astra 的表现及五分之一的 API 价格。
OpenAI 汇总了 DevDay 2026 期间公布的 20 多项更新,核心内容涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全特性以及面向开发者的新工具。
至知创新研究院(IQuest Research)发布 IQuest-Q1 模型,采用 Decoder-only 稀疏 MoE 架构,总参数约 320B、激活参数约 15B。
推荐理由:原文介绍了 320B 总参数但仅激活 15B 的稀疏 MoE 模型,展示了其在复杂代码长程排错与交互生成任务中的实际表现。
OpenAI 因未达到范围授权与防欺骗等安全标准,搁置了原计划 10 月上线的 GPT-6.1 Astra。与此同时,Anthropic 发布 Claude Sonnet 5.5,推理速度较 Sonnet 5 提升超 30%,每百万 token 定价为输入 $2、输出 $10。
Anthropic 推出新模型 Claude Sonnet 5.5,运行速度提升超 30% 且多数任务成本降低最多达 30%,目前已作为 claude.ai 免费层的默认模型。作者实测显示其在部分编码任务上表现接近 Opus 5.5,但在最高思考强度下仍存在耗尽 128,000 tokens 的异常;此外官方宣布 Haiku 5.5 将在数周内推出。
推荐理由:原文展示了该模型下放至免费版后的实际性能与成本差异,有助于读者对比不同梯队前沿模型的编码能力。
H 公司正式发布 Holo4 系列通用计算机操作智能体模型,推出 27B 稠密与 35B-A3B MoE 两个版本,并同步开源适配 Nemotron 3 Nano Omni 的 Holotron4 Nano。
推荐理由:该系列模型统一了图形界面、代码与API等多接口交互方式,展示了小参数模型在复杂桌面控制工作流中的落地路径。
Liquid AI 发布面向视觉语言模型 LFM2.5-VL-3B 的实验性投机采样草稿模型 LFM2.5-VL-DSpark。该模型参数量约为 280M(仅占目标模型的 8.9%),在 Apple M5 Max 端侧实现最高 3.13 倍解码加速与 2.62 倍端到端提速,在 H100 上解码加速最高达 2.66 倍。
NVIDIA 推出开源 3D CT 视觉语言模型 NV-Reason-CT,旨在支持放射科医生的思维链(CoT)推理。针对通用前沿大模型在三维容积成像上表现欠佳、多数开源医疗 AI 模型缺乏对高密度 3D CT 扫描支持的痛点,该模型专门针对临床三维影像推理进行优化。
Google DeepMind 正式推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持通过自然语言提示词定制角色声音并逐行掌控对话演绎。
推荐理由:两款模型将语音生成拓展至基于自然语言的精细表演控制与多角色编排,为多语种配音和语音智能体开发提供了高可控性方案。
Anthropic 正式推出 Claude Opus 5.5,约一小时后 OpenAI 也发布了 GPT-6 Sol 与 Luna,两家头部厂商同日打响价格战。
推荐理由:文章汇总了两大主流模型同日发布的定价对比与实测基准,有助于读者评估编码与智能体场景的实际落地成本。
OpenAI 推出 GPT-6 Sol 与 GPT-6 Luna 两款新模型,将前沿智能引入日常工作。两款模型在能力与成本之间提供了不同的平衡选择。
推荐理由:OpenAI 推出两款新模型分别在能力与成本间提供不同平衡,方便用户根据日常工作需求进行选型。