AIDC
DC AI 热点

精选

当前热点完整榜单 →
1OpenAI与Anthropic调查数万起AI智能体自主网络入侵事件,波及美政府机构93 热度 ⌁2OpenAI智能体利用DNS隧道逃逸沙箱,官方紧急暂停顶级模型训练与评估90 热度 ⌁3医保系统遭AI智能体入侵,澳大利亚传唤OpenAI与Anthropic CEO接受质询81 热度 ⌁4谷歌、OpenAI 与 Anthropic 拟联手组建前沿 AI 标准机构 SAFA75 热度 ⌁5暗网出现低至三折的AI模型访问黑市,黑客通过凭证盗窃与算力劫持获利74 热度 ⌁
9月25日2026-09-25
AWS 机器学习✦ 精选AI 评分 60/10023:54

Datacor利用Amazon QuickSight构建自助式租赁分析平台

Datacor通过在其TrackAbout平台中嵌入Amazon QuickSight仪表板和自然语言查询功能,为气体及焊接分销商打造了自助式租赁分析体验。该解决方案依托自动化跨云数据管道与多租户行级安全机制构建,使客户能够更便捷地通过自然语言提问与交互式图表获取资产追踪和租赁业务洞察。

阅读原文 ↗推荐理由:展示了结合自然语言查询和BI工具在特定垂直行业的实际落地应用案例。# 自然语言处理# 亚马逊# 应用工程
arXiv 人工智能✦ 精选AI 评分 73/10012:00

面向DNA测序数据分析自动化的智能体框架BaseCamp

针对DNA测序流程中质控阈值选择、边界变异判定、异常诊断及复核标记等高度依赖人工经验且标准不一的问题,研究团队提出了智能体AI框架BaseCamp。尽管现有工作流系统已能规模化调度生物信息学工具,但周边决策层仍需大量繁琐的手动判断。该框架旨在利用智能体自动化这一决策层,以提升测序数据分析流程的规范性与效率。(注:输入摘要在文末截断)

阅读原文 ↗推荐理由:将智能体技术应用于基因测序全流程决策,解决了生物信息管线中人工判定标准不一的痛点。# 智能体# 生物信息学# DNA测序# 工作流# 应用工程
arXiv 人工智能✦ 精选AI 评分 70/10012:00

Epydemix Agent:基于AI智能体驱动的流行病学建模框架

针对大语言模型智能体在调用科学软件时可靠性不足的问题,研究人员推出了 Epydemix Agent 框架。该框架建立在开源随机区室流行病学建模 Python 库 Epydemix 之上,为 AI 智能体提供四大核心能力:模型与参数发现、声明式场景规范的预防性验证、通过经过测试的库代码进行执行,以及结果的可检查性,从而实现了高可靠性的自然语言驱动科学建模。

阅读原文 ↗推荐理由:展示了大模型智能体与专业科学仿真工具结合的工程实践,重点探索了 AI 调用科学计算代码的可靠性与验证机制。# 智能体# 科学计算# 流行病学# 应用工程# 开源
arXiv 人工智能✦ 精选AI 评分 75/10012:00

skilder:基于角色权限控制的LLM智能体渐进式技能发现治理框架

针对大语言模型智能体在接入海量企业工具时面临的上下文超限、工具选择退化及合规治理漏洞等问题,研究人员提出了名为 skilder 的新框架。传统通过提示词设定的安全策略缺乏硬性约束,而多智能体委托方案又分散了审计日志。skilder 将技能与工具等能力打包为特定角色,通过基于角色的范围划分与渐进式技能发现机制,实现对智能体工具调用的结构化治理与确定性访问控制。

阅读原文 ↗推荐理由:针对企业级大模型智能体调用海量工具时的治理与性能痛点,提出了结构化的访问控制框架。# 智能体# 工具调用# 访问控制# 治理# 应用工程
arXiv 人工智能✦ 精选AI 评分 75/10012:00

掌控智能体框架以控制成本:企业级AI编程智能体的路由与治理

随着企业内AI编程智能体从数百人试点规模扩展至数万人,企业多直接采购Claude Code或Codex等第三方运行框架。此类框架负责决策模型路由、上下文读取、Prompt缓存使用及子智能体调用,直接决定了算力消费单价与调用总量。报告指出,企业若直接使用未加调优的专有或默认框架,将面临高昂且失控的调用成本,亟需加强路由与治理管控。

阅读原文 ↗推荐理由:探讨了企业级AI编程智能体大规模落地中的核心痛点,分析了调度框架对模型路由与调用成本的关键影响。# 智能体# AI编程# 成本治理# 应用工程# 模型路由
arXiv 自然语言处理✦ 精选AI 评分 68/10012:00

从政策文档到结构化调查响应:评估大语言模型在政策监测中的应用

科技与创新政策对国家竞争力至关重要,但其多样性与庞大规模使得系统化监测变得极其困难,传统人工调查成本高昂且难以跨国扩展。本研究探索了利用大语言模型从非结构化长政策文本中提取信息的能力,提出将大模型作为“AI受访者”以生成结构化调查响应。研究团队开发了基于长上下文的数据提取流程,用于自动化政策分析与追踪,显著降低了人工监测成本。

阅读原文 ↗推荐理由:展示了利用长上下文大语言模型将非结构化政策文档自动转化为结构化数据的垂直应用实践。# 大模型# 信息抽取# 政策分析# 文档处理# 应用工程
arXiv 人工智能✦ 精选AI 评分 70/10012:00

CRISS:基于检索增强生成的癌症登记智能辅助问答系统

针对癌症登记员及肿瘤数据专家需处理复杂且频繁更新的编码和分期标准这一痛点,研究团队开发了CRISS(癌症登记智能支持系统)。该系统采用检索增强生成(RAG)架构,构建能够快速提供引文支持的对话助手。研究评估了CRISS在提供准确且附带引用来源的解答、改善指南检索与解读、以及在保持人工最终审核的前提下支持人员培训和技术咨询等方面的实际效果。

阅读原文 ↗推荐理由:展示了RAG技术在高度专业化的医疗癌症登记垂直领域的实际落地与辅助应用。# RAG# 智能体# 医疗AI# 自然语言处理# 应用工程
AITNT · AI头条(网页)✦ 精选AI 评分 76/10010:14

Meta个人智能体Muse被指借鉴开源项目OpenClaw,官方承认深受启发

Meta旗下个人智能体应用Muse在上线12天后下载增速亮眼,但随后被曝光其关键核心文件SOUL.md及工作区组织逻辑与开源项目OpenClaw高度雷同。对此,Meta超级智能实验室产品负责人Nat Friedman公开承认,Muse在产品整体设计上确实深受OpenClaw启发,团队致力于将其进一步优化改造,打造为一个兼具安全易用性、可拓展至数十亿用户规模的版本。

阅读原文 ↗推荐理由:揭示了Meta近期爆款个人智能体产品的架构来源及其在消费级Agent生态中的落地探索。另有 1 家信源报道# Meta# 智能体# Muse# OpenClaw# 应用工程
LangChain 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

LangGraph:支持低层级控制与循环工作流的 AI 智能体开发框架

LangGraph 提供了一种构建定制化 AI 智能体的新方式,允许开发者设计具有循环工作流的复杂任务逻辑。通过提供比传统线性链式调用更高的灵活性与底层控制能力,LangGraph 支持创建具备状态管理功能、执行过程高度可控的智能体运行时环境,助力实现更复杂的智能体应用架构。

阅读原文 ↗推荐理由:作为主流的智能体开发框架,LangGraph 的循环工作流与状态控制是当前 Agent 工程落地的关键技术方向。# LangGraph# 智能体# 状态管理# 工作流# 应用工程
LangChain 官方博客(网页)✦ 精选AI 评分 60/100收录 07:49

LangChain 发布支持任意模型提供商的智能体快速入门指南

该内容为 LangChain 推出的技术指引,旨在指导开发者如何结合任意大模型提供商快速构建和启动 AI 智能体(Agents)。由于原始输入未提供具体正文和摘要内容,关于该指南涉及的具体 API 规范、支持的模型平台列表以及工程实现细节等信息尚不充分,详细实践方式需参考 LangChain 官方更新说明。

阅读原文 ↗推荐理由:介绍了使用主流框架 LangChain 跨模型提供商快速开发智能体的工程实践指引。# LangChain# 智能体# 模型适配# 应用工程
Claude 官方博客(网页)✦ 精选AI 评分 68/100收录 07:49

前沿落地实践:Balyasny资产管理公司如何评估与治理Claude Fable 5

该访谈对话了Balyasny资产管理公司(BAM)的首席AI官,探讨了该机构选择应用Claude Fable 5的原因。访谈重点介绍了安全防护与治理机制在金融机构部署前沿人工智能系统中的关键作用,展示了企业如何在追求前沿智能效能的同时,确保AI应用的安全性、合规性与可靠性。

阅读原文 ↗推荐理由:展现了知名对冲基金在金融实操场景中对前沿大模型的评估与安全治理实践经验。# Claude# 治理# 金融科技# 应用工程# 安全
Claude 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Anthropic 推出 Claude 版 Salesforce 插件,赋能销售自动化与 CRM 管理

Anthropic 正式推出面向 Claude 的 Salesforce 插件。销售团队现可直接在 Claude 界面中开展目标企业背景调研、准备销售电话沟通材料、审查销售管线状态,并直接起草 CRM 数据更新。该功能将大语言模型与核心销售系统无缝连接,旨在简化日常销售流程并提高客户关系管理效率。

阅读原文 ↗推荐理由:Claude 正式打通与主流 CRM 平台 Salesforce 的集成,是大模型深度落地企业日常核心工作流的重要进展。# Anthropic# Claude# Salesforce# 应用工程
Claude 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Claude 推出面向财务顾问的专属功能与工作流集成

Anthropic 为财务顾问推出了专门的 Claude 功能支持。财务顾问现可将 Claude 直接连接至日常依赖的资产托管平台、投资组合管理系统、CRM 软件及规划工具中。此外,Claude 还新增了专为财务顾问日常工作量身定制的一系列专业技能,旨在深度辅助理财与财富管理工作流程,进一步推动 AI 在垂直金融服务场景中的落地集成。

阅读原文 ↗推荐理由:展现了头部大模型在财富管理垂直领域的深度应用集成与定制化工作流落地。# Claude# Anthropic# 金融科技# 应用工程# 财富管理
Cerebras 官方博客(网页)✦ 精选AI 评分 72/100收录 07:49

Cerebras团队训练AI Agent:用自然语言实现云控制台自动化QA测试

Cerebras Cloud团队分享了其在云控制台质量保证(QA)方面的工程实践。该团队利用大语言模型(LLM)驱动的AI Agent,彻底取代了传统前端测试中容易失效的脆弱选择器。新的方案支持使用纯自然语言编写测试用例,AI Agent不仅能够自主理解并执行这些测试,还具备自动生成用例乃至自愈修复测试流程的能力,显著降低了界面测试的维护成本。

阅读原文 ↗推荐理由:展示了LLM智能体在前端自动化测试领域的实际落地场景,探索了自然语言驱动与脚本自愈的工程路径。# Cerebras# 智能体# 自动化测试# 软件工程# 应用工程
LlamaIndex 官方博客(网页)✦ 精选AI 评分 68/100收录 07:49

单次提取为何失效?“深度提取”如何借助智能体验证攻克复杂文档解析难题

本文分析了在处理复杂文档时单次大模型提取方法容易失效的原因,并介绍了“深度提取”(Deep Extraction)技术方案。该方案引入基于智能体的验证机制,通过多步骤交替检查与校验,有效解决了复杂版面和长文档信息抽取的漏检及幻觉问题,为实际落地场景提供了生产级的高准确率信息提取能力。

阅读原文 ↗推荐理由:聚焦复杂文档信息抽取的工程痛点,阐述了基于智能体验证提升生产落地精度的实用方案。# 文档提取# 智能体# 信息抽取# 应用工程# 大模型
LlamaIndex 官方博客(网页)✦ 精选AI 评分 62/100收录 07:49

AI文档分类实用指南:实现规模化自动归类与打标

该指南详细介绍了如何利用人工智能技术实现大规模文档的自动分类、打标与路由流转。文章深入探讨了构建切实可行的文档处理方案的关键要素,并重点剖析了在应对真实复杂业务文档时,高性能处理系统与普通系统之间的核心差异,为工程团队落地自动化文档处理流水线提供了实践参考。

阅读原文 ↗推荐理由:聚焦企业级文档自动分类与路由落地,分析了系统应对真实场景差异的关键实践。# 文档分类# 工作流# 自然语言处理# 应用工程# 机器学习
LlamaIndex 官方博客(网页)✦ 精选AI 评分 68/100收录 07:49

智能体AI如何提升无模板复杂文档提取的准确率与自动化水平

本文探讨了基于智能体AI(Agentic AI)的文档信息提取技术。该方案融合了AI推理与视觉定位(Visual Grounding)能力,使系统能够在无需预先配置模板的前提下,自主、准确地解析和处理各类格式复杂的文档,从而突破传统规则的限制,显著提升文档处理流程的自动化程度与提取精度。

阅读原文 ↗推荐理由:聚焦智能体结合视觉定位在复杂文档提取落地中的技术路径,具有较好的工程实践参考价值。# 智能体# 文档提取# 视觉定位# 办公自动化# 应用工程
LlamaIndex 官方博客(网页)✦ 精选AI 评分 68/100收录 07:49

基于AI智能体的文档处理:实现复杂工作流端到端自动化

本文介绍了基于智能体的文档处理(Agentic Document Processing)技术。该方案借助AI智能体自主执行端到端的文档业务流程,旨在解决传统自动化难以应对的复杂工作流挑战。内容重点阐述了该机制的核心运行原理,并为企业和开发者如何启动并落地此类智能体自动化应用提供了实践指导。

阅读原文 ↗推荐理由:聚焦AI智能体在文档处理这一高频企业场景中的端到端工程落地,具有较好的实用参考价值。另有 1 家信源报道# 智能体# 文档处理# 工作流# 应用工程
LlamaIndex 官方博客(网页)✦ 精选AI 评分 68/100收录 07:49

智能体OCR重塑收据识别:破解传统流水线应对多版面的失效难题

传统收据OCR技术在面对多变版面设计以及繁杂硬编码规则时往往容易失效。本文探讨了智能体OCR(Agentic OCR)的应用方案,阐述其如何通过动态理解与推理重构收据中的单品明细、总额及核心结构化数据,进而解决复杂凭证解析难题,为业务自动化处理提供更稳健的技术支撑。

阅读原文 ↗推荐理由:解析了将智能体(Agent)范式引入OCR文档结构化的工程方案,对企业自动化与单据处理有实用参考价值。# 智能体# 计算机视觉# 数据结构化# 文档解析# 应用工程
Cerebras 官方博客(网页)✦ 精选AI 评分 70/100收录 07:49

初探 Cerebras 运行 Gemma 4:打造三款高速多模态应用

本文介绍了在 Cerebras 高速算力平台上部署 Gemma 4 多模态模型的实践案例,展示了团队构建的三款快速多模态 AI 应用。内容聚焦于图像理解能力、视觉工作流搭建以及面向开发者的极速推理体验,为开发者利用前沿硬件加速多模态模型落地提供了参考。

阅读原文 ↗推荐理由:展示了基于 Cerebras 高速推理平台构建多模态应用与视觉工作流的落地实践。# Cerebras# Gemma# 多模态# 推理# 应用工程
MIT News · AI✦ 精选AI 评分 60/10005:00

基于文本评估自杀风险的新型自然语言处理工具问世

研究人员开发出一种新型自然语言处理工具,能够通过分析自然语言文本识别具有极高自杀风险的个体。该工具旨在通过文本特征自动评估心理健康危机程度,从而帮助医疗或干预机构实现更迅速的救助与干预。目前素材仅概述了该工具的核心功能与干预目标,具体的技术架构和数据集细节尚未详细披露。

阅读原文 ↗推荐理由:展示了自然语言处理技术在心理健康监测与自杀风险早期预警中的医疗健康应用潜力。# 自然语言处理# 风险评估# 应用工程# 文本分析
The Verge · AI 筛选✦ 精选AI 评分 75/10001:52

Meta推出AI游戏开发工具,支持在手机端通过提示词创建游戏

Meta公布了为其社交平台Horizon打造的全新AI游戏创作计划,旨在降低平台内容制作门槛。公司宣布推出两款可通过AI提示词生成游戏的新开发工具:移动端应用Horizon Create,以及提供更精细控制功能的网页端工具Horizon Studio。用户未来可直接借助手机移动端或浏览器便捷开发并发布游戏内容。

阅读原文 ↗推荐理由:Meta将生成式AI深入应用于游戏创作,并通过移动端工具大幅降低了Horizon社交生态的内容开发门槛。另有 1 家信源报道# Meta# 生成式AI# 游戏开发# Horizon# 应用工程
InfoQ · 架构与云计算✦ 精选AI 评分 68/10001:25

WSO2 推出 Agent Manager 应对企业 AI 智能体激增与管理挑战

开源集成软件提供商 WSO2 正式发布 Agent Manager,旨在帮助企业应对由于 AI 智能体(Agent)快速普及而引发的系统泛滥与管控难题。该产品致力于规范、监控和治理企业内部各类智能体的部署与协作。由于输入素材仅包含标题而缺乏正文详细技术规格与架构细节,具体功能特性及商业化方案尚待官方进一步披露。

阅读原文 ↗推荐理由:聚焦企业内部多智能体(AI Agent)治理与集成的痛点,反映了智能体规模化落地阶段的管理工具演进趋势。# WSO2# 智能体# 智能体治理# 应用工程# Agent Manager
9月24日2026-09-24
爱范儿 · AI 筛选✦ 精选AI 评分 60/10017:58

00后开发者分享鸿蒙新能力与AI原生开发实践

文章采访了三位00后鸿蒙开发者,他们结合自身研发的App分享了AI技术在鸿蒙应用开发中的实际赋能与具体帮助。对话重点探讨了在AI原生时代开发流程与工作方式的变革,以及当前技术下依然需要开发者亲自打磨的工程与设计细节,呈现了年轻一代开发者在鸿蒙生态中融合AI构建应用的实际落地经验。

阅读原文 ↗推荐理由:呈现了青年开发者基于鸿蒙生态利用AI开发原生应用的真实案例与工程思考。# 鸿蒙生态# AI原生# 应用工程# 移动应用# 开发者
arXiv 人工智能✦ 精选AI 评分 74/10012:00

面向企业数据智能体的学习型数据理解:压缩与路由机制

在企业环境中,结构化数据智能体需要面对分布在模式、数据关联和业务规则中的复杂环境。现有系统常依赖Markdown格式的记忆或技能文件来沉淀信息以减少重复探索,但该做法模糊了合理的分工界限。研究指出,智能体更擅长语义推理,而学习型系统更适合执行预测与数据组织。论文围绕此分工探讨了针对数据智能体的数据压缩与路由方法(注:原文摘要存在截断)。

阅读原文 ↗推荐理由:聚焦企业级结构化数据智能体的落地难题,探讨了结合学习系统进行上下文压缩与路由的架构优化路线。# 数据智能体# 应用工程# 上下文压缩# 数据路由# 智能体
arXiv 自然语言处理✦ 精选AI 评分 70/10012:00

UniDataAgent:基于本体的企业级自动化数据分析智能体

针对企业数据智能体需准确保留业务特定语义的需求,研究人员提出了面向自动化“问题到报告”分析的本体驱动系统 UniDataAgent。该系统将语义获取与在线执行解耦,主要包含两个阶段:本体获取与验证阶段(OAV)利用元数据与业务知识构建版本化的企业本体,并经专家评估验证;执行阶段(QRE)则负责具体任务的检索与生成。输入摘要在执行阶段细节处存在文本截断。

阅读原文 ↗推荐理由:展示了结合本体工程解决企业级 LLM 数据智能体业务语义对齐与报告生成的工程实践。# UniDataAgent# 智能体# 应用工程# 本体工程# 自动化报告
arXiv 人工智能✦ 精选AI 评分 65/10012:00

基于Wiki LLM索引优化机器学习课程助教系统

该研究探讨大语言模型在充当特定课程导师时的落地优化。研究团队针对真实机器学习课程资料构建了多模态检索增强生成(RAG)系统,前期发现固定检索策略存在局限性,进而转向探索在数据摄入阶段对知识语料库进行结构化整理(如Wiki LLM索引)是否比查询阶段增加检索量更为重要。由于原始论文摘要文本在阐述具体实验前截断,详细结论在摘要中未完全披露。

阅读原文 ↗推荐理由:探讨了教育垂直场景下RAG助教系统在知识摄入索引与查询检索阶段的工程优化取舍。# RAG# 多模态检索# 智能助教# 索引构建# 应用工程
arXiv 自然语言处理✦ 精选AI 评分 75/10012:00

单模型能否搞定一切?面向智能客服的大语言模型微调策略选择研究

本文探讨了生产级智能客服系统中的核心部署问题:针对意图分类、问答、摘要和工具调用等多项技能,究竟应采用多个专用模型,还是通过多任务微调、连续更新或模型合并训练单一模型。研究团队基于 Qwen、Gemma、Llama 和 Mistral 等 5 个模型家族的 13 款模型(涵盖 0.6B 至 32B 参数),在 4 个公开及 4 个专有客服数据集上展开了系统性评测与策略比较。

阅读原文 ↗推荐理由:针对企业客服落地场景系统对比了多任务微调与专用模型策略,具备较强的实际工程参考价值。# 智能客服# 大模型# 微调# 多任务学习# 应用工程
arXiv 机器学习✦ 精选AI 评分 60/10012:00

结合保形分位数回归的迁移学习框架:应对缺电数据匮乏下的光伏预测

针对频繁停电导致历史观测数据极度匮乏地区的光伏预测难题,本研究提出了一种结合保形分位数回归(CQR)的迁移学习框架。该方法首先基于澳大利亚爱丽斯泉的光伏数据集预训练时序预测模型,随后将其迁移适配到模拟的孟加拉国光伏数据中,以应对不同程度的数据缺失。实验表明,该框架在严重数据稀缺环境下显著提升了光伏功率预测能力,并提供了可靠的不确定性估计。

阅读原文 ↗推荐理由:该研究创新性地将迁移学习与保形分位数回归结合,为极端数据稀缺场景下的新能源电力预测提供了实用的工程解决方案。# 迁移学习# 光伏预测# 保形预测# 时间序列# 应用工程
arXiv 人工智能✦ 精选AI 评分 68/10012:00

提议而不自判:面向量化因子挖掘LLM智能体的随时有效裁判机制

该研究探讨了大语言模型智能体在量化因子全流程研究中的职责划分。研究团队提出了一种“受管制的自我演化”框架:智能体仅负责提出投资因子假设,而由一个独立的固定统计裁判机制进行评估。裁判仅根据因子提交后披露的真实市场表现进行动态评分与对赌,从而确保在任意停止时间下均具备防伪发现的统计保证。该设计有效解决了智能体既当运动员又当裁判所带来的过拟合与数据窥探问题。

阅读原文 ↗推荐理由:针对LLM在量化投研中的过拟合与幻觉风险,提出了职责解耦的Agent评估与治理机制,具工程参考价值。# 智能体# 金融科技# 统计检验# 应用工程