前TikTok全球运营负责人再创业,用AI给宠物打造平行世界
前TikTok全球运营负责人周秉俊与胡禹丞创立Lollapalooza,推出AI应用Furever,通过上传照片为离世宠物生成持续更新的图文视频并模拟互动。该产品陆续上线了Memory Wall、Voice Capsules和Companion Mode等功能,构建包含时间与天气变化的虚拟世界。团队还推出了支持长期记忆与桌面提醒的个人助手Furever Dock。
前TikTok全球运营负责人周秉俊与胡禹丞创立Lollapalooza,推出AI应用Furever,通过上传照片为离世宠物生成持续更新的图文视频并模拟互动。该产品陆续上线了Memory Wall、Voice Capsules和Companion Mode等功能,构建包含时间与天气变化的虚拟世界。团队还推出了支持长期记忆与桌面提醒的个人助手Furever Dock。
作者分享了结合 AI Agent 进行长途自驾游规划的实操工作流,通过人工确立核心主题与主线、Agent 辅助核对票务规则及对抗性审查,解决一键生成攻略脱离实际的问题。流程涵盖结合小红书点点与一手政策挖掘信息、排查隐藏规则冲突、比选住宿餐饮,并最终导出为离线 HTML 路书。文中还提供了开箱即用的 Agent 旅游规划师初始化提示词。
开发者在 Hacker News 发帖探讨如何在 Codex 与 Claude Code 等 AI 编程智能体触及用量限制时,无缝切换工具且不丢失当前任务上下文。作者指出目前相关迁移工具缺乏实用生态,且因难以承受单 Agent 费用从每月 $20 跃升至 $100-$200,希望向社区寻求低成本的应对方案。
命理工具 Fateshow 融合东西方命理体系,采用先按公开规则生成可逐行核对的排盘、再由 AI 输出行动建议的模式。该产品整合了紫微斗数、八字、西洋占星、人类图以及六爻、奇门遁甲、梅花易数和雷诺曼等多套占卜工具。用户输入出生信息或起卦要素后,AI 可针对职业方向、人际契合度及交易决策等问题提供具体解答。
百度沧海·存储推出 BOS、CDS、CFS 和并行文件存储 PFS 等产品,针对传统 HPC、AI HPC 与 HPDA 提供高性能存储方案。方案重点优化数据加载与 Checkpoint 阶段的高吞吐及低延时表现,解决海量小文件元数据瓶颈。系统支持 POSIX 接口、MPI-I/O 框架与 K8s CSI 体系,有效减少算力空转并降低成本。
Arm 在年度大会上发布 Neoverse CSS N4 与 Arm AGI CPU 两款产品,分别面向定制芯片落地与高响应智能体 AI 的量产就绪需求。Arm AGI CPU 具备 300 瓦 TDP 的能效表现,可合规交付中国市场,Arm 借此从纯 IP 授权向兼顾芯片供应转变以拓展数据中心计算生态。
开发者为 M5Stack PaperMono(ESP32-S3,3.97 英寸 480×800 墨水屏)开发并开源了一套冰箱购物清单固件与配套系统。项目包含约 2,400 行 C++ 固件与 FastAPI 后端,支持与手机网页同步、离线编辑及防残影快速局部刷新。服务端还支持可选接入 Claude,自动将新增商品按超市货道进行智能归类。
当前大模型工具将事实核查与代码审查责任完全推给用户,本质上仍停留在演示层面而非严肃的生产力工具。严肃的 AI 产品应将错误校验设为核心功能,提供带复选框的对比工作表、原始引文展示、可复现控制、显式上下文占用监控以及不依赖提示词的底层文件系统沙箱。在组织流程层面,企业必须引入轮岗制度防止工程师警惕性衰退,并安排持续的手工实践以避免核心技能退化。
MicroLLM Lab 支持在浏览器中直接运行并评测 7 款微型大语言模型(包含 135M 参数级别)。平台通过正则和精确 token 匹配等客观指标测试模型的准确率与生成速度(tokens/s),所有运行数据均保留在本地设备。此外,用户还可以使用 JavaScript 编写自定义基准测试,直接对模型的解码文本进行验证。
英伟达推出开放智能体安全平台(Open Agent Safety Platform),为 AI 智能体构建沙箱隔离与访问限制系统,防止智能体脱离控制。平台核心组件包括运行在 CPU 上的 OpenShell 与运行在网络芯片上的 Sentry 监控工具;部分软件开源并作为参考设计,英伟达已联合微软、思科等合作伙伴,并正与 Anthropic 合作推进云端智能体集成。
推荐理由:原文给出了通过网络芯片与处理器隔离智能体权限的工程方案,读者可借此了解软硬件结合的安全防护架构。
开源项目 ESP32s3-LLM-Cluster 实现了在 7 块 ESP32S3 微控制器集群上分布式流水线运行切分后的 0.5B BitNet 1.58-bit 大语言模型。
PastForward 系统通过细粒度复用任务执行中的计算经验,有效加速端侧 GUI 智能体的 VLM 推理。该系统在解码时检索历史输出序列作为多 token 提议并在单次前向传播中验证,同时跨动作步骤提前推理并传递可复用的 KV 状态。在 AndroidWorld 基准测试中,PastForward 在保持任务成功率的同时实现了 1.63-2.36x 的端侧单步延迟加速。
研究团队推出测试平台 GameBoyWorlds,用于评估 AI 智能体在无示范与奖励环境下的自主自我提升能力。其包含涵盖 5 个游戏系列共 500 项短程任务的 Execution 子集,前沿模型开箱完成率不足 50%;Playthrough 子集则测试两款宝可梦同人游戏的端到端通关。实验表明,配备多模态记忆与分层子目标的高级智能体管线仍未能达成首个主要里程碑。
针对 AI 智能体跨会话无状态和定制记忆碎片化问题,研究提出将智能体记忆构建为独立的可插拔中间件层。该方案围绕双向可插拔、多租户隔离、写入路径一致性及生命周期治理等六大系统挑战展开,并推出了参考实现 ALTK-Evolve,用于支持智能体跨会话持久化经验并实现自我改进。
研究展示了由 DeepSeek V4 Flash 与 DeepSeek Harness 框架驱动、在消费级硬件上端到端自主执行的机器学习科研案例。实验在 Apple M2 Pro 纯 CPU 硬件上运行,评估了 FFT 核岭回归求解器,求解耗时 78.7 s、峰值 RSS 为 1.57 GB。
研究人员提出 EngramRAG 智能体记忆架构,通过低延迟清醒反射与异步梦境巩固循环解决多跳依赖和记忆衰减问题。在 LoCoMo 基准测试中,EngramRAG 的 Recall@5 达 53.21%(较稠密向量 RAG 相对提升 38.9%),MRR 达 0.4203。
研究提出无需训练的多智能体潜空间通信方法 CacheBack,通过接收端提供的信息需求描述来过滤并压缩发送端的 KV cache。在 FanOutQA 基准上,基于 Qwen 3 的 CacheBack 削减了 75% 的传输状态,相比文本通信将准确率提升 14.7 个百分点,任务完成延迟中位数降低 3.2x。该方案在稠密 Transformer、Mamba 混合架构等多种模型族上均实现类似优化。
SenseAgent 是一个面向跨域 IMU 动作识别的 LLM 智能体,将大语言模型作为运行时规划器以实现自适应闭环感知。系统基于目标流数据生成无标签诊断报告,动态调度重力感知、原型迁移及风格归一化等工具,并通过验证器评估决策安全性。实验表明,该方案在设备位置变化和复合偏移场景下显著提升了感知性能,且支持在无需重训骨干网络的前提下利用少量用户反馈。
研究人员提出 CSI-Agent,将跨域 Wi-Fi CSI 感知的自适应重构为部署阶段的决策问题。该方法将目标域行为总结为类别级证据,利用大语言模型规划器决定各类别保留默认策略还是调用专门动作,并通过确定性验证减少不可靠干预。在 4 个公开数据集的 1-shot 自适应评测中,CSI-Agent 平均 Macro-F1 较最强基线提升约 16%。
现成的 Codex 与 Claude Code 智能体可在可执行目标指引下自主开展科学性能工程优化。在粒子追踪的固定半径近邻(FRNN)搜索任务中,智能体自主移除了 PyTorch 依赖并生成独立的 C++/CUDA 库,精确复现了基准结果。其同步 NumPy 接口相比原 PyTorch 接口实现 1.6 倍加速,并在多种 GPU 架构上均观察到类似提升。
研究人员提出了符号指导分类法(SGT),通过引入算法符号指导来调控 LLM 智能体在分布式多智能体协同中的自主权。实验表明,提供部分伪代码指导的中间自主度水平,其协同表现持续优于完全开放的自然语言推理与完全硬性规定的算法执行。该发现将自主度调控确立为基于 LLM 开展分布式协同的关键设计原则。
BioDyad 提出在蒙特卡洛图搜索中设立科学与工程双层架构,以协同生物医学发现与机器学习工程。科学层将先验指导与迭代发现结合并记忆复用方案,工程层推动候选程序完成冒烟测试、训练验证评估及全数据重训练。在包含 76 个任务的 BioXArena 基准评测中,BioDyad 在 3 种 LLM 后端下的任务成功率和全任务得分均位列第一。
研究团队推出评测基准 EmailBench,在 16 个类别的 206 个企业邮件与生产力场景中评估 LLM 智能体。该基准采用 258 个可执行静态断言与 211 个 LLM 评分标准,对 8 种语言模型配置展开测试。结果显示最佳配置的场景通过率仅为 33.5%,尽管其 99.7% 的工具调用无 API 故障,表明有效工具执行并不等同于任务完成。
研究人员推出开源协议 Choir,用于实现分布式多智能体定理自动形式化。Choir 将形式化项目分解为独立任务,支持各贡献者运行自带 LLM 订阅的 AI 智能体并通过 GitHub 协作,所有提交均由确定性门控检查后合并。该协议采用模块化设计且支持扩展,目前已兼容 Lean 4、Isabelle 和 Rocq。
研究人员提出强化学习框架 COUNTERMEM,利用可执行世界模型在动作失败后生成并验证反事实记忆,以提升语言智能体的跨任务表现。在搭配 gpt-oss-120b 时,该框架在 6 个领域的 12 个基准上将 ReAct 与 Reflexion 的表现平均提升 12.6 个百分点,并将运行 token 消耗降低 7.7% 至 42.0%。基础大语言模型在流程中保持固定,代码将在论文接收后开源。
OpenAI 发布名为 Dots 的全天候 AI 智能体产品,该智能体拥有圆润卡通虚拟形象。相关域名 dot.com 已于 7 月过户至马斯克旗下的 xAI,目前访问该域名会直接跳转至 Grok 应用下载页,而契合度更高的 dots.com 域名则归属于一家已停业的公司。
DeepSeek 宣布开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、计算库及分布式通信库,与英伟达平台开源组件一一对应。
推荐理由:原文给出了底层编译与通信组件从英伟达向华为昇腾的对应适配细节,有助于评估国产算力在训练和算子开发上的可用性。
鸿蒙智行问界汽车宣布问界新 M8 开启预售,预售价 38.98 万元起。新车由赛力斯与华为联合设计开发,搭载华为乾崑智驾 ADS 5 及全向立体融合感知系统,全系标配面向 L3 级自动驾驶的架构设计。车辆全系采用 800V 架构,纯电版续航 830km,增程版综合续航 1435km。
豪威(OmniVision)推出常开型视觉 AI 协处理器 OAX7700,集成 NPU 单元,构建的停车监控系统功耗仅为现有方案的 3%。该芯片具备人体检测与测距等边缘 AI 能力,常开模式下检测到事件可即刻切换并录制 5~10 秒预录视频。OAX7700 采用 5.5×3.5 (mm) BGA 封装,现已出样并计划于 2027 年第 1 季度量产。
豆包宣布上线综合出行服务,用户可通过自然语言对话一站式完成机票预订、火车票购买、打车及路线导航。该功能接入了航班管家、高铁管家、曹操出行以及百度地图等第三方服务商,并同步推出了涵盖导航、交通、住宿与游玩建议的“出行用豆包”专属入口。
研究团队推出基准测试 OptiArena,用于评估 LLM 能否在 5 轮代码修改及固定资源预算下优化可执行博弈算法。对 12 款前沿 LLM 与 5 款游戏的实证测试表明,模型在提升较弱初始算法上的表现明显更稳定,但在不破坏既有性能的前提下优化成熟基线算法仍具挑战。该研究代码已开源,论文已被 EMNLP 2026 录用。
文章整理了实测可用的16个免费AI模型Token渠道,涵盖限时活动、长期免费层及国内平台大额度三类方案。内容涉及阶跃星辰Step 5、Qoder、Cline、Google Gemini API、GitHub Copilot Free、Kilo Code、Groq、火山引擎豆包及智谱等平台的额度细节,并提供了按日常写代码、批量任务与原型测试分层搭配的使用策略。
研究人员提出 Contextual Early Reward(CER),通过轨迹前缀中的行为证据为长周期代码智能体提前预测终端奖励。
OpenAI 在 DevDay 上发布全天候常驻 Agent dots,配备独立云端电脑和浏览器并支持接入超 4000 种工具,可在后台全天候自动化执行建站与代码重构等任务。
推荐理由:原文汇总了常驻智能体与协作空间的架构变化及定价,读者可以据此评估全天候自动化工作流对团队协作模式的影响。
豆包输入法正式补齐 HarmonyOS NEXT 与 Windows 版本,实现 iOS、Android、HarmonyOS NEXT、macOS 及 Windows 五大平台全覆盖。新版本支持账号多端实时对齐个人词库、跨设备文字与图片超级互传,并升级了气声与方言识别、离线语音以及长语音结构化文字整理功能。此外,键盘端还加入了行内计算、语义续写及手势快捷删除等交互特性。
推荐理由:原文详细梳理了跨端词库同步与 AI 文字整理等实测细节,展示了端侧大模型如何降低日常多设备输入阻力。
研究团队提出即插即用框架 Omni-IO Skills,通过分层技能、标准化多模态执行接口、依赖感知编排以及持久化资产注册表,让现有 AI 智能体无需修改核心推理逻辑即可实现全模态能力。
9 月 28 日,鸿蒙智行智界 RX 正式上市,共推出 6 款配置,售价 25.98 万至 38.98 万元。新车提供 81kWh 与 100kWh 电池,CLTC 续航最高 852km,四驱版零百加速 3.6 秒,并在 Ultra 版搭载面向 L3 级的四激光雷达与冗余架构。发布会还同步上市了焕新智界 R7(23.98 万元起),并开启享界 V8 预售(32.98 万元起)。
OpenAI 在开发者大会上公布了全天候自主智能体 Dot、人机协作空间 ChatGPT Space 以及主力模型 GPT-6.1 Sol 等一系列新品。
推荐理由:原文系统梳理了 OpenAI 构建智能体协作平台的多款新品细节与定价对比,有助于读者评估其对现有开发及企业工作流的综合影响。
Cerebras 上线智谱 GLM-4.7 推理支持并发布迁移指南,依托晶圆级集群实现最高 1500+ tokens/s 的输出速度。
推荐理由:文章总结了 GLM-4.7 的行为特性与十条工程迁移规则,读者可以直接参考这些参数设置与 Prompt 技巧优化推理效率。
企业级低代码智能体平台 StackAI 正式接入 Cerebras 推理服务,为其合规审查、理赔与信贷决策等多步工作流提供亚秒级响应,推理速度最高比 GPU 快 15 倍。在金融、医疗及政务等高合规场景中,该集成使多步工作流延迟降低最高达 50%,高峰期吞吐稳定性提升最高 10 倍,工作流级推理成本降低 20–35%。