长期技术观察 / LONG-TERM OBSERVATION

AI 软件工程与研发自动化的长期观察站

持续观察 AI 如何改变软件工程、研发系统与组织协作,从技术动态、开源项目和真实实践中,识别值得长期跟踪的变化。

Weekly
#288
Signals
27
Essays
67

本周 Signal

Signal #28 · 2026.09.07

AI 开始获得代码合并审批权

本周,Copilot 开始允许管理员授权 AI 正式批准代码合并请求,批准结果可以计入仓库的合并要求。VS Code Agent Merge 则持续处理评审意见、失败检查和冲突,推进到可合并状态。 此前,Vercel 的软件工厂 已让 Agent 完成实现、验证和评审,再由人最终...

HOW IT WORKS

从信息到判断,是一条连续的研究链路

这里不追求把所有信息摆在读者面前,而是持续筛选、组织和验证,最终留下可以复用的判断。

LONG-TERM TOPICS

长期追踪的六个问题

它们不是短期热点标签,而是理解 AI 如何改变软件工程的一组持续问题。

LATEST OBSERVATIONS

最近的技术观察

查看全部文章
2026-09-07 周一01

Signal #28:AI 开始批准代码合并了

本文是「每周 Signal|AI × SE」第 28 期,欢迎关注和交流~ AI 开始获得代码合并审批权。当实现和评审都交给 Agent,判断所需的依据也要进入自动化流程。 9 月 1 日,GitHub 宣布 Copilot 可以正式批准 PR,也就是代码合并请求。管理员授权后,

#Agent PR#Weekly Signal
2026-08-31 周一02

Signal #27:Agent 的工作,不该只存在 Session 里

本文是「每周 Signal|AI × SE」第 27 期,欢迎关注和交流~ Agent Session 可以保存,但随着任务变长、多次执行和多 Agent 接力,一项工作的长期状态正在逐渐从单次 Session 中拆出来。任务、决策、产物和验证结果可能需要由更长期的 Worksp

#Workspace#Memory
2026-08-24 周一03

Signal #26:Agent 明明发现了风险,为什么还会继续执行?

本文是「每周 Signal|AI × SE」第 26 期,欢迎关注和交流~ HarnessRisk 的实验显示,部分 Agent 虽然能够识别恶意指令或越权风险,危险动作仍可能发生。本文结合 OpenAI、Google 和 AWS 本周的安全实践,讨论模型的风险识别为什么还不够,

#AI#Software Engineering
2026-08-20 周四04

Vercel 开始造“软件工厂”了:AI Coding 的下一站,不是更多 Agent

当 Coding Agent 可以并行完成越来越多任务,研发效率的瓶颈也开始从代码生成向 Review、验证和风险判断迁移。Vercel 最近在 AI SDK 上运行的 Software Factory,已经把这件事推进到了真实生产环境:下一阶段真正需要重新设计的,可能不是 Agent 能写多少代码,而是整个研发系统如何消化这些工作。 本文是「企业研发 AI 自动化」系列第 40 篇,欢迎关注和交流。

#Vercel#AI Coding

RESEARCH LIBRARY

形成判断之前,我们从哪里看见变化

公众号、主题导航和 arXiv 共同构成支撑长期观察的信息与研究基础设施,并作为 Signal 和技术观察的资料来源。

ABOUT THE EDITOR

由真实研发实践持续校准的个人观察

长期关注 AI 软件工程、研发自动化与 Agent 系统,持续维护技术周刊,并参与真实团队中的 AI 研发落地与开源实践。这里记录的不是旁观式评论,而是问题、实践与判断之间的往返。

关于梯度不陡
梯度不陡|AI 软件工程与研发自动化