跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

100条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 21–40 条 · 共 100 条
9月30日周三
  1. Cerebras 官方博客(网页)66

    Cerebras 发布 AI 生成美观 UI 的实用方法指南

    Cerebras 总结了利用 AI 生成高质量 UI 的 8 种实践方法,以解决通用提示词容易产出千篇一律 SaaS 仪表盘与卡片嵌套的问题。核心方案包括接入 shadcn/ui 的 MCP 服务器以读取真实组件源码、在编码前通过 Design Tokens 与 Tailwind 配置固化视觉规范,以及结合视觉模型截图进行小步精准迭代。

    推荐理由:原文总结了 AI 生成 UI 的典型缺陷与 8 种实用改进方法,读者可据此建立更具约束力的高效前端开发工作流。

  2. Cerebras 官方博客(网页)65

    Cerebras 推出 Kimi K2.6 万亿参数企业级推理服务

    Cerebras 宣布面向企业客户测试开放万亿参数开源模型 Kimi K2.6 的高速推理服务。经 Artificial Analysis 独立实测,Cerebras 运行 K2.6 的生成速度达每秒 981 个 output tokens,针对 10k 输入加 500 输出的复杂请求总耗时仅 5.6 秒,比官方接口快 29 倍。

    推荐理由:原文给出了万亿参数模型在晶圆级硬件上的实测吞吐与端到端延迟对比,读者可据此评估高速推理对智能体编码工作流的提速幅度。

  3. Cerebras 官方博客(网页)61

    Cerebras 重构工程师技术面试:全面引入 AI 辅助并重点考察验证能力

    Cerebras 宣布全面改造工程团队的技术面试流程,明确允许并期望候选人使用 AI 辅助编码,将考核重心从孤立的语法与算法记忆转向真实工程场景。面试通过多步骤复杂任务考察候选人的问题拆解、上下文提供、代码验证、调试及生产环境权衡能力。Cerebras 指出 AI 让候选人更快完成初版代码,团队据此将“代码验证与查错能力”设为最高优先级的评估信号,坚持候选人必须对最终交付的系统负全责。

    推荐理由:Cerebras 复盘了将 AI 引入技术面试的实践细节,展示了工程团队在 AI 原生时代如何重构对工程师验证与判断能力的考核标准。

  4. Claude 官方博客(网页)73

    Anthropic 推出生命科学 AI 方案与 Claude Science 公测版

    Anthropic 宣布推出面向生命科学领域的 AI 方案,并开启科学家 AI 工作台 Claude Science 的公开测试。该平台可连接 PubMed、bioRxiv 等科研数据库与分析工具,支持生物信息学数据处理、文献综述、临床试验方案拟定与 FDA 监管文档起草,同时结合 Claude Code 重构遗留科学代码。

    推荐理由:原文展示了面向生命科学的完整工具链与落地用例,读者可了解大模型在生物医药研发和合规文档流程中的实际落地方式。

  5. Cloudflare Blog · 网络基础设施78

    Cloudflare 发布面向智能体的全新 CLI 工具 cf

    Cloudflare 宣布推出面向 AI 智能体开发的全新命令行工具 cf,覆盖全平台超过 3,000 项 API 操作,并开启全球公开测试。cf 默认采用紧凑 JSON 输出以节省上下文,提供支持自然语言检索指令的 `cf cli search`,并引入基于 TypeScript 的全新配置文件 `cloudflare.config.ts` 与 Vite 开发环境。

    推荐理由:工具将整个平台三千多项 API 封装为类型化且适合智能体检索调用的命令行,为自动化基础设施管理提供了直接参考。

  6. Google Developers · AI 筛选72

    Google 解析 Harness 工程:如何评测、迭代与守护 AI 编码智能体

    Google 开发者团队分享了针对 AI 编码智能体的 Harness 工程实践,主张引入细粒度行为评测(Behavioral Evaluation)来替代单纯依赖端到端大盘基准打分。

    推荐理由:文章拆解了 AI 编码智能体从端到端打分转向中间行为断言的评测框架,为工程团队防范提示词调整与模型升级中的行为退化提供了可落地的方法。

  7. AWS 机器学习80

    AWS 宣布在 Amazon Bedrock 与 Claude Platform 上线 Claude Sonnet 5.5

    AWS 正式在 Amazon Bedrock 和 Claude Platform on AWS 上提供 Claude Sonnet 5.5。该模型针对聚焦型编程和知识工作优化,具备更快的执行速度与更低的任务单价,支持与 IAM、CloudTrail、CloudWatch 及 Bedrock Guardrails 等 AWS 原生治理工具集成。

    推荐理由:文章明确了该模型在企业工程中的分工定位与调用方式,便于开发者评估架构组合与成本配比。

  8. TechCrunch AI87

    OpenAI 发布 GPT-6.1 Sol:性能接近 GPT-6 Astra 且价格更低

    OpenAI 在 DevDay 活动上正式发布 GPT-6.1 Sol 模型,称其在智能体编码、计算机操作及专业工作上的智能水平接近 GPT-6 Astra,而标准输入与输出 token 价格仅为后者的五分之一。

    推荐理由:新模型以五分之一的价格提供接近旗舰模型的智能水平,并改进了低推理强度下的事实准确率与安全遵从度。

  9. TechCrunch AI78

    OpenAI 为 Codex 推出支持跨设备的可重用云端开发环境及多项更新

    OpenAI 在 DevDay 上为软件工程智能体 Codex 推出可跨设备访问的持久化可重用云开发环境,帮助团队共享统一配置并让任务更快启动。更新还涵盖支持语音启动任务与新增 /agents 视图的 Codex CLI、ChatGPT 桌面端的代码审查新体验,以及能够离线扫描 GitHub 仓库并排错的 Codex Security Cloud。

    推荐理由:云环境由临时沙箱转向持久可配置空间,有助于降低跨端协作门槛并加速日常开发流程。

  10. Cerebras 官方博客(网页)66

    Cerebras 详解用自然语言 AI 智能体自动化测试云控制台的实践

    Cerebras 详细介绍了其内部构建的端到端测试框架 console-prompt-tests,使用纯自然语言描述测试用例,并由大语言模型智能体通过 Playwright MCP 协议驱动真实浏览器完成交互与校验。

    推荐理由:原文详细拆解了用自然语言智能体驱动浏览器测试与自动修复前端漂移的架构,为研发团队重构端到端测试流程提供了可落地的参考。

  11. Claude 官方博客(网页)75

    Claude Code 企业版正式推出

    Anthropic 推出面向企业团队的 Claude Code 企业版,支持在终端、各类 IDE 和 Slack 中基于全代码库自主编写、调试与重构代码。企业版提供集中式管理面板配置 MCP 服务与权限、OpenTelemetry 监控指标导出,以及 SSO/SCIM 统一身份管控。

    推荐理由:官方给出了企业级管控、部署支持与安全架构细节,有助于技术管理者评估团队引入自主编程工具的合规与落地路径。

  12. Claude 官方博客(网页)84

    Claude Code 开发者文档概览:支持终端、IDE、桌面与网页端多平台

    Anthropic 提供了智能体编程工具 Claude Code 的官方开发者概览文档,详细说明其能够理解完整代码库、跨文件编辑并自动执行命令的核心能力。该工具全面支持终端 CLI、VS Code/Cursor 扩展、JetBrains 插件、独立桌面应用以及网页端五大运行环境,各端统一共享 CLAUDE.md 规则与 MCP 服务。

    推荐理由:原文汇总了智能体编程工具在终端、IDE、桌面及网页端的多平台接入方式,便于开发者快速评估其与现有工作流的适配度。

  13. Claude 官方博客(网页)85

    Anthropic 推出 Claude Platform 智能体开发平台

    Anthropic 推出 Claude Platform 开发者平台,整合前沿模型、智能体运行框架与上下文管理等全套基础设施。平台提供 Fable 5.1、Opus 5.5、Sonnet 5.5 和 Haiku 4.5 模型矩阵,支持最高 100 万 token 上下文、代码执行、计算机操作(Computer use)及 MCP 协议。

    推荐理由:原文汇总了最新模型矩阵定价与智能体开发套件,便于开发者评估多步骤任务与企业级工作流的迁移成本。

  14. Claude 官方博客(网页)77

    Claude 全平台应用开放下载:支持桌面端、移动端与 Linux 跨设备联动

    Claude 正式开放全平台应用下载,覆盖 macOS、Windows、Linux(Beta)以及 iOS 与 Android 移动端。桌面端支持本地文件访问、桌面扩展与企业级安装部署(MSIX/PKG),并深度集成了 Claude Code 与 Claude Cowork,支持移动端通过 Remote Control 向 CLI 发送任务。

    推荐理由:原文汇总了全平台客户端与扩展连接功能,读者可以据此了解跨设备协同开发与本地工具调用的具体支持情况。

  15. Claude 官方博客(网页)84

    Anthropic 发布 Claude Haiku 4.5 模型

    Anthropic 正式推出 Claude Haiku 4.5,在编码、电脑使用及智能体任务上达到 Sonnet 4 水平,并在 SWE-bench Verified 基准测试中取得 73.3% 的成绩。

    推荐理由:原文对比了该轻量模型与旗舰版本的编码和推理表现,读者可以据此评估多智能体协作与大规模调用的性价比边界。

  16. Claude 官方博客(网页)89

    Anthropic 发布 Claude Sonnet 5.5

    Anthropic 正式推出 Claude Sonnet 5.5 混合推理模型,具备 1M 上下文窗口,运行速度相比 Sonnet 5 提升 30% 且典型工作流成本降低最高达 30%。

    推荐理由:官方公布了新模型的定价与多场景实测数据,开发者可以据此评估高频编码与 Agent 任务的替换成本。

  17. Claude 官方博客(网页)86

    Anthropic 发布 Claude Fable 5.1 大模型

    Anthropic 正式发布 Claude Fable 5.1 大语言模型,主打长周期、异步及跨应用的复杂编码与深度知识工作。模型 API 定价为输入每百万 token 10 美元、输出每百万 token 50 美元,缓存读取费用降至每百万 token 0.25 美元,已面向订阅用户及主要云平台开放。

    推荐理由:原文详细说明了新模型的定价变化、降本幅度与安全路由机制,有助于评估复杂长周期任务的迁移成本。

  18. Claude 官方博客(网页)77

    Claude 推出插件市场 Marketplace 提供 340 款一键安装工具与 MCP 集成

    Claude 推出插件市场(Claude Marketplace),聚合了 340 款整合工具、技能与集成的插件并支持一键安装。市场覆盖了 GitHub、Microsoft Playwright、Vercel、Supabase、Figma 等官方 MCP 服务与开发套件,支持在 Claude Code 中完成代码审查、浏览器自动化测试、云端部署与设计稿转代码等任务。

    推荐理由:原文给出了插件市场的具体分类与集成工具清单,读者可以据此评估将外部开发工具接入工作流的可行性。