Signal #31:AI Coding 正在深入存量系统改造
GitHub 本周更新的 Copilot 运行时迁移复盘披露:Agent 写下迁移中的大部分代码,最终形成 80 多万行 Rust;128 个 PR 逐步合入、发布。GitHub Security Lab 新发布的 Fuzzing Taskflow则让 Agent 为既有 C/C++ 项目编写模糊测试程序、分析覆盖率和排查崩溃。Anthropic 在 Opus 5.5 发布中也提到一位早期试用者的大型代码迁移案例。
这些案例表明,AI Coding 正在更深入地参与存量系统中的复杂工程任务。 GitHub 的迁移展示了一种做法:把改造拆成可合并、可发布的变更,用原有端到端测试核对行为,由工程师判断架构和风险,Agent 持续参与实现。那些规模大、步骤多的系统改造,正在获得新的推进方式。

2026-09-23|淘宝天猫海外技术的AI Native研发范式升级实践与思考
淘宝天猫海外技术团队以钉钉群组织业务、产品、研发与不同职责的 Agent,让需求信息随开发过程持续流转。
团队在供给、支付、营销等场景试点:小型需求尝试在群内完成需求澄清、任务拆解与开发交付,较大需求继续结合 IDE 和评审流程推进。人负责需求确认、关键决策与最终验收,Agent 承担资料整理和执行工作。文章的参考价值在于具体的人机分工与交接方式;自主研发员工等进一步设想,应与当前试点能力区分。
2026-09-20|高德导航Live模式:从“一次做对”到“变化后还能做对”的时空Agent架构
高德导航 Live 模式围绕持续变化的时间、地点和用户目标,组织可调整、可恢复的长程任务。
系统结合时空记忆、事件触发和动态规划,在路况、目的地或用户安排变化后重新判断下一步,并处理语音交互中的打断与恢复。工程实现同时涉及检索效率、首字延迟和执行状态管理。文章展示了出行 Agent 如何维护一段行程中的约束,而其搜索与延迟数据对应团队披露的具体测试场景。
2026-09-23|大模型在货拉拉营销广告的应用实践
货拉拉将广告配置与分析拆成可调用的业务流程,让模型提出操作方案,再由后端校验权限与数据后执行。
助手通过意图识别和 NL2API 调用已有能力,以业务数据字典统一字段含义;较大的结果由后端保存并用批次标识关联,前端按需读取。模型生成的中间方案须通过校验才能落库。团队报告配置与报表耗时下降约 75%、异常分析耗时下降约 50%,这些数字属于其业务实践结果,不能直接推广到其他广告系统。
2026-09-24(9 月 25 日更新)|阿里云刚发布的 AgentCore 有何不同?
2026-09-22|从个人生产力到企业生产力,阿里云发布企业级 Agent 平台 AgentCore
AgentCore 将运行时、沙箱、身份、网关、可观测与评估能力组织为企业 Agent 的公共服务。
平台介绍了接入不同开发框架和已有 Harness 的方式,并支持多 Agent 的角色分工、任务协作及能力资产管理。两篇文章分别侧重产品发布与架构说明,可用于了解平台承担哪些运行和治理职责。文中的完成率、成本降幅等宣传数据缺少足够的测试条件说明,本次摘要不将其作为选型结论。
2026-09-22|阿里云发布 Alibaba Cloud AI Agent Handbook,阐述“智能面积”
2026-09-23|阿里云AgentCore|同题发布
Alibaba Cloud AI Agent Handbook 以 30 章串联架构、构建、运行、治理、调优与企业实践。
手册覆盖任务状态、上下文、工具执行、沙箱、身份权限、轨迹数据和评估等问题,帮助团队明确模型、应用与平台各自承担的职责。业务知识、Skills 和评测集被视为需要持续维护的工程资产。发布文章提出的“智能面积”属于解释投入方向的概念,本次主要保留可查阅、可讨论的工程内容。
2026-09-22|Agent 已经进入工作流,文件还要靠人传来传去?
火山引擎 ADrive 将项目资料以共享目录提供给人与 Agent,并结合版本、权限与审计管理文件协作。
Agent 可以通过本地挂载访问授权目录,团队成员继续在同一批资料上审阅、修改和分享,减少下载、上传与附件转发。文章演示了项目级资料组织及未授权写入被拒绝的流程。这里的重点是把身份和目录权限落实到文件访问;共享文件仍需配合团队的版本确认与交付约定。
2026-09-23|AgentKit 模型网关上手指南|告别多模型管理混乱
AgentKit 模型网关将多模型接入所需的凭证管理、限流、预算控制和调用统计集中配置。
应用通过代理密钥调用模型,网关管理上游凭证与路由策略,并提供调用失败后的回退配置。文章以接入开发工具的操作流程说明如何分配访问能力、查看用量和控制消耗。这是一篇基础设施使用指南,适合关注多团队、多模型接入管理的读者;回退模型的能力差异仍需应用侧验证。
2026-09-23|错误码排查从 3~8 小时到分钟级,Agent怎么做到的?
腾讯以单 Agent 调用知识库、代码关系、可观测数据和 Git 工具,逐步核对错误码背后的原因与证据。
调查过程区分代码逻辑与线上实际状态,保留信息来源,并用规则与模型配合解析异常链路。团队在 50 个案例上报告,行动建议一致率由 66% 提升至 88%。标题中的“分钟级”指诊断阶段,完整修复仍可能需要半天至两天;文中启发式置信评分也不能直接当作经过校准的正确概率。
2026-09-21|看清 Coding Agent:从执行记录到风险调查
LoongSuite-Pilot 统一采集不同 Coding Agent 的执行事件,供 AgentLoop 结合上下文调查异常行为。
采集端把模型请求、响应与工具调用映射为统一事件,通过会话、轮次、步骤和调用标识关联起来,并支持输出前的敏感信息脱敏。审计侧结合规则和前后文追查风险操作,回答发生了什么、由哪一步触发、涉及哪些数据。完整记录有助于调查,但发现风险与事前阻止风险是不同能力。
2026-09-24|阿里云发布 AgenticOps 全栈能力,让 Agent 成为运维与研发的第一用户
阿里云围绕观测数据、语义关联和工具接口组织 AgenticOps,尝试串联调查、执行与结果验证。
发布内容包括云监控 2.0 与 UModel、面向 Agent 的 Skill、CLI 和 MCP,以及 AgentLoop、STAROps 和研发流程集成。它们分别承担数据理解、执行过程观测和运维任务推进等职责。文章还介绍了根因分析评测资源。作为平台能力发布,更适合关注接口与职责划分;实际自动化范围仍取决于接入数据、授权和验证机制。
2026-09-21|设计开源:CloudAI Design Goes OpenSource!
CloudAI Design 将设计指南与工程套件结合,尝试让 Agent 在生成界面时使用明确的设计规则和组件约束。
文章介绍 Playbook 与 Toolkit 两部分:前者说明如何表达设计判断,后者组织主题、Design Tokens、组件、模板、Skills 和生成式 UI 能力,并介绍 OneSkill 接入方式。可参考其如何把抽象的视觉要求拆成执行步骤与评审条件。本次已核对官方组织中的 Playbook;套件各项能力的可用状态仍以对应项目文档为准。
项目:Alibaba-Cloud-Design|Vibe Designing Playbook
2026-09-21|怎样构建一个 Agent-friendly 的网站
Rspress 通过构建阶段生成 Markdown,并暴露文档索引与逐页入口,方便 Agent 发现和读取内容。
实现包括 SSG-MD、llms.txt、llms-full.txt,以及在托管层按 Accept: text/markdown 返回对应内容。页面还注入可被解析器读取的入口提示,减少 Agent 从深层链接进入后找不到索引的问题。相关检查用于验证内容入口与格式,不能代表回答准确率。
时间说明:按采集稿收录本周公众号文章;官网版本标注首发于 2026-08-20、最后更新于 2026-09-21,作为工程实践补充收录。