跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

100条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 61–80 条 · 共 100 条
9月25日周五
  1. GitHub Blog · AI 与安全74

    GitHub Security Lab 开源 AI 模糊测试工具 Fuzzing Taskflow

    GitHub Security Lab 推出基于 Taskflow Agent 的自主模糊测试流水线 Fuzzing Taskflow,可全自动完成 C/C++ 项目的代码入口识别、Harness 编写、AFL++ 执行与崩溃分类。该框架将大语言模型的调度决策与 MCP 工具执行解耦,内置覆盖率反馈驱动的用例迭代与结构感知变异机制,并在测试结束后自动生成包含根本原因分析和修复补丁建议的漏洞报告。

    推荐理由:展示了将大模型决策与工具执行解耦的自动化模糊测试闭环设计,为软件安全工程提供了实用的落地参考。

9月23日周三
9月22日周二
  1. 阶跃 StepFun 公众号65

    阶跃星辰 Step 5 Preview 正式上线 TRAE

    阶跃星辰宣布 Step 5 Preview 正式上线豆包旗下 AI 开发工具 TRAE,用户可在全流程开发工作流中直接调用。该模型覆盖 9 类任务与 33 种编程语言,支持代码库理解、跨文件修改、重构与持续数小时的长程任务推进,官方公布其 DeepSWE 得分为 67.7 分,ProgramBench 通过率为 80.5%。

    推荐理由:阶跃星辰将 Step 5 Preview 接入 TRAE 开发环境,并给出了该模型在 33 种编程语言下的代码评测数据。

9月21日周一
9月20日周日
  1. 阶跃 StepFun 公众号75

    阶跃发布旗舰模型 Step 5 Preview

    阶跃星辰发布面向 Agentic 任务的旗舰模型 Step 5 Preview,即日起全量开放 API 与在线体验,并定于 10 月 15 日正式释放模型权重。

    推荐理由:原文给出了稀疏架构与长程任务的具体指标,读者可以据此评估其在复杂工程与专业研究中的能效表现。

9月17日周四
  1. AWS News · 云基础设施77

    AWS 重塑开发者起步体验:支持第三方登录并适配编码智能体

    AWS 推出面向 AI 开发者的全新简化入门体验,支持使用 Google、GitHub 或 Apple 账号免信用卡直接注册,并提供 100 美元免费额度。系统以项目方式自动隔离权限与成员协作,开发者可直接将配置提示词接入编码智能体,由其自动部署资源并管理底层权限,当业务扩展时可无缝激活完整 AWS 高级功能。

    推荐理由:AWS通过免信用卡登录、自动分配权限以及与编码智能体对接,大幅降低了云端部署基础设施的起步门槛。

9月13日周日
  1. AI Roundup · X AI coding圈日报72

    Dario Amodei 提议放缓前沿大模型推进步伐,Sam Altman 支持而 David Sacks 等人公开反驳

    Dario Amodei 发文呼吁全行业放缓前沿模型能力迭代速度,建议设立常驻独立评估机构并推进国际协同,以防范递归自我改进等带来的系统性风险。Sam Altman 与 Elon Musk 明确表示赞同并称将落实独立评测,但 David Sacks 与 Armin Ronacher 批评该提议实质是闭源寡头借合规与反垄断豁免实施监管俘获。

    推荐理由:材料集中呈现了关于放缓前沿大模型研发节奏的多方交锋,有助于理解闭源巨头诉求与开源社区对监管俘获的警惕。

9月8日周二
  1. NVIDIA Developer Blog61

    NVIDIA 推出 CUDA Rust:提供两条路径编写 GPU 内核

    NVIDIA 宣布推出 CUDA Rust,正式支持使用 Rust 语言进行原生 GPU 内核编程。继 CUDA C++ 与 CUDA Python 之后,NVIDIA 计划在 2027 年及未来持续完善 CUDA Rust 工具链,以支持推理引擎、服务基建与智能体运行时等 AI 系统层软件的开发。

    推荐理由:NVIDIA 将 GPU 内核编程拓展至 Rust 生态,为 AI 系统层与推理基础设施开发提供了新的工具选择。

9月6日周日
9月3日周四
  1. Hugging Face81

    Hugging Face 开源编码智能体持久化记忆层 funes

    Hugging Face 开源了面向编码智能体的持久化记忆层工具 funes,支持将 Claude Code、Codex、pi、Hermes 等智能体的历史交互轨迹转化为可检索的记忆。

    推荐理由:通过将智能体交互轨迹转化为可检索的结构化数据集,开发者可以在不同编码智能体和设备间保留历史决策背景与原始依据。

  2. Hugging Face72

    基于 TRL 与 OpenEnv 训练代码模型绘制水彩画的开源实践

    Hugging Face 工程师开源了基于 TRL 与 OpenEnv 的强化学习训练管线,复现了通过代码生成水彩画的方法。该方案采用 Qwen3.5-35B-A3B 编写约 150 行 p5.brush 的 JavaScript 代码,结合 HPSv3 美学评分模型与 Qwen3-VL 成对评判器构建主观审美奖励函数,利用 GRPO 强化学习引导模型对齐特定绘画风格。

    推荐理由:原文完整开源了用强化学习引导代码模型绘制水彩画的工程管线,展示了如何将人工审美偏好构建为成对比较的奖励函数。

  3. Google DeepMind85

    Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber

    Google DeepMind 推出 Gemini 3.8 Flash 与专用于网络安全的 Gemini 3.8 Flash Cyber 两款新模型,主打长程编程、智能体工作流与漏洞自动修复能力,保持与 3.7 Flash 相同的定价(输入 $0.75 / M tokens,输出 $3.75 / M tokens)。

    推荐理由:原文给出了两款模型的基准数据与定价细节,开发者可以据此评估其在长程编码与安全防御场景中的落地可行性。

8月28日周五
  1. 腾讯混元 公众号82

    腾讯混元发布旗舰开源模型 Hy4 preview

    腾讯混元正式发布并开源新一代旗舰模型 Hy4 preview,总参数 770B,激活参数 49B,支持 1M 上下文长度。该模型面向软件工程、办公分析、游戏开发与科学研究等真实生产力场景优化,在 203 个内部工程任务盲测中均分达 2.99/4.00。模型现已在 Hugging Face、GitHub、腾讯云 TokenHub 及 OpenRouter 等平台上架。

    推荐理由:该模型以 770B 总参数和 1M 上下文切入真实生产力场景,读者可据此了解其在长程工程与科学计算中的实际落地表现。

8月27日周四
8月26日周三
  1. 智谱 公众号85

    智谱开源原生多模态模型 GLM-5.3-Flash

    智谱正式上线并开源 GLM-5 系列原生多模态模型 GLM-5.3-Flash(320B-A18B),在综合智能指数与编程评测中取得与 Claude Opus 4.8 相当的表现。

    推荐理由:该模型在综合评测中追平海外顶级旗舰,并通过混合注意力架构与国产芯片部署大幅压低了调用成本。

8月25日周二
  1. NVIDIA Developer Blog62

    CUDA Python 1.0 发布:提供稳定 API 与底层平台完整访问能力

    NVIDIA 发布 CUDA Python 1.0,提供稳定的 API、统一基础架构以及对 CUDA 平台的完整访问能力。该版本旨在解决 Python 开发者此前要么手写 CUDA C++ 扩展、要么完全依赖 PyTorch 或 CuPy 等上层库的局限。

    推荐理由:原文阐述了 CUDA Python 1.0 提供的稳定 API 与平台访问能力,有助于开发者评估如何降低 Python 调用底层 GPU 的开发门槛。

8月19日周三
  1. 智谱 公众号81

    智谱上线 GLM-5.3 API:综合智能指数达 60 分且权重将于下周五开源

    智谱宣布 GLM-5.3 API 正式上线,模型权重将于下周五开源,调用定价与上一代 GLM-5.2 保持一致。该模型擅长复杂编码、防御性网络安全与长程任务,在 Artificial Analysis 综合智能指数中取得 60 分,与 Kimi K3 并列开源模型第一。

    推荐理由:原文公布了评测表现、调用定价与开源时间表,开发者可以据此评估将该模型接入复杂编码或长程任务工作流的成本效益。