跳到正文

MCP 与工具调用

模型连接外部世界的协议与实践:MCP 生态、function calling、工具链集成的动态。

最新精选

第 41–54 条 · 共 54 条
9月28日周一
  1. CNCF Blog71

    Stacklok 开源云原生 Agent 框架 Mecatl

    Stacklok 宣布开源云原生 AI 智能体框架 Mecatl,将核心 Agent 循环与客户端、执行环境、工具系统及会话存储解耦,支持在 Kubernetes 等分布式环境中弹性部署与滚动更新。

    推荐理由:文章阐述了将智能体运行循环与执行环境和会话存储解耦的云原生架构设计,为大规模多租户部署提供了工程参考。

  2. Hugging Face74

    H 公司发布通用计算机操作智能体模型系列 Holo4 与 Holotron4 Nano

    H 公司正式发布 Holo4 系列通用计算机操作智能体模型,推出 27B 稠密与 35B-A3B MoE 两个版本,并同步开源适配 Nemotron 3 Nano Omni 的 Holotron4 Nano。

    推荐理由:该系列模型统一了图形界面、代码与API等多接口交互方式,展示了小参数模型在复杂桌面控制工作流中的落地路径。

9月25日周五
  1. GitHub Blog · AI 与安全74

    GitHub Security Lab 开源 AI 模糊测试工具 Fuzzing Taskflow

    GitHub Security Lab 推出基于 Taskflow Agent 的自主模糊测试流水线 Fuzzing Taskflow,可全自动完成 C/C++ 项目的代码入口识别、Harness 编写、AFL++ 执行与崩溃分类。该框架将大语言模型的调度决策与 MCP 工具执行解耦,内置覆盖率反馈驱动的用例迭代与结构感知变异机制,并在测试结束后自动生成包含根本原因分析和修复补丁建议的漏洞报告。

    推荐理由:展示了将大模型决策与工具执行解耦的自动化模糊测试闭环设计,为软件安全工程提供了实用的落地参考。

9月23日周三
9月18日周五
9月17日周四
  1. 月之暗面 Kimi 公众号70

    Kimi 发布金融行业解决方案

    月之暗面正式推出 Kimi 金融行业解决方案,整合了 10 余个权威数据源、9 项专属金融技能和 5 项合规安全措施。该方案通过 MCP 接入 Wind 万得、东方财富与标普全球等数据源,提供财务建模、研报生成和交互式图表等端到端交付能力,并支持通过 Computer Use 联动本地软件。此外,方案联合中信建投证券共建风险评估网关,通过数据分类分级、授权拦截和责任审计实现合规业务落地。

    推荐理由:方案通过 MCP 接入数据源并封装出九项金融技能,为智能体在强合规与高密度投研场景的落地提供了具体工作流范式。

9月10日周四
9月1日周二
8月31日周一
  1. AWS News · 云基础设施80

    AWS 宣布收购 DuckLabs,并汇总 ARD 智能体规范与 AWS CLI Agent 工具包更新

    AWS 宣布签署最终协议收购 DuckDB 背后的 DuckLabs 公司,DuckDB 将在独立基金会和 MIT 协议下保持开源,联合创始人继续主导技术方向并逐步与 S3、Redshift 和 SageMaker 等服务融合。

    推荐理由:原文汇总了 AWS 收购 DuckLabs 的开源定位以及智能体资源发现规范等动态,读者可以了解云厂商在数据分析与 Agent 生态上的整合走向。

8月27日周四
  1. Anthropic News(RSS)74

    Anthropic 开放模型硬件标准 MHS 研究预览,支持 AI 智能体跨设备控制物理硬件

    Anthropic 宣布开启模型硬件标准(MHS)的研究预览,该共享规范旨在让 AI 智能体安全操作显微镜、移液器和机械臂等各类科研与制造硬件。MHS 引入标准化驱动程序,通过基础读写原语和自然语言元数据让设备具备可发现性,并支持通过 MCP、CLI 及代码文件与模型协同,将硬件集成时间从数周缩短至数小时。

    推荐理由:该标准将原本需要数周的实验室跨设备集成缩短至数小时内,展示了智能体通过统一协议调度物理硬件的工程路径。

7月15日周三
6月24日周三
  1. 通义实验室 公众号77

    通义实验室开源原生语言世界模型 Qwen-AgentWorld

    通义实验室正式开源原生语言世界模型 Qwen-AgentWorld 及其评测基准 AgentWorldBench。该模型基于超 1000 万条真实交互轨迹,经由继续预训练、监督微调和强化学习三阶段训练,覆盖 MCP、Search、Terminal、SWE 等文本类及 Web、OS、Android 等 GUI 类共七大领域。

    推荐理由:模型通过对环境交互显式建模来降低沙箱试错成本,为智能体强化学习和跨任务泛化提供了可控模拟路径。

12月30日周二
  1. Sebastian Raschka67

    Sebastian Raschka 发布 2025 年大语言模型年度综述与技术预测

    Sebastian Raschka 发布 2025 年大模型年度盘点与预测,指出大模型演进的核心驱动力已转向以 RLVR 与 GRPO 为代表的后训练推理以及推理时扩展。

    推荐理由:系统梳理了推理模型、后训练强化学习与混合架构的演进,为读者研判大模型技术路线与工程落地提供了多维度参考。