AI代码审查需独立评估架构:打破“自审自”的信任陷阱

源自125位全网作者

05-16 15:20

内容由AI生成

精选参考来源

1. 瞒过全人类57年!Claude揪出阿波罗登月代码中的隐藏Bug

2. 字跳TRAE团队发了个《2026 企业级AI编程实践手册》,总结了他们的AI编程方法论和工程实践网页链接“在2026年,AI编程已不再是实验性的尝试,而应该成为企业软件开发的核心生产力。本手册源于TRAE团队在构建AI编程助手过程中的真实实践——我们用AI构建AI,在这个过程中积累了从方法论到工程实践的完整经验。这不是一本理论书籍,而是一线研发团队的实战总结。我们将分享如何将AI真正融入企业级开发流程,如何建立可复制的工程规范,以及如何让团队从“会用AI”到“精通AI编程”。无论你是技术决策者、架构师还是一线开发者,都能在这里找到可落地的方法和工具。AI时代的软件开发不是替代人类,而是重构协作方式。让我们一起探索这个新范式。”#How I AI#

3. Anthropic推出Claude Security公开测试版,AI直接扫描生产代码漏洞

4. OpenAI最新Harness工程分享 | 代码免费后,码农将变身“AI驾驭师”

5. Anthropic 发布了一份《2026 Agent 编程趋势报告》,提出了八个预测,核心观点是:写代码这件事正在从"人写"变成"人指挥 AI Agent 写"。网页链接报告有替 Claude Code 打广告的成分,但数据跟我日常用编程 Agent 的体感比较吻合,可以拿来看看 2026 年开发者的工作正在怎么变。【前言:从辅助到协作】报告开头回顾了 2025 年的变化:编程 Agent(Coding Agent)从实验性工具变成了真正能交付功能的生产系统。工程团队发现,AI 已经能处理完整的开发工作流,包括写测试、调 bug、生成文档、在复杂代码库里导航。预测 2026 年这种变化将不再局限于工具的小修小补,而是会引发一场质变:1)单打独斗变团队作战:原本单一的智能体,将进化为协同工作的"智能体团队"。2)效率飞跃:以前需要耗费数小时甚至数天的任务,现在只需极少的人工干预就能完成。3)角色转变:几年前还在逐行写代码的工程师们,将转型为指挥官。他们将通过编排长期运行的智能体系统来处理实现细节,从而腾出手来专注于架构和战略。这场变革的核心是"协作"。虽然开发者在 60% 的工作中都会用到 AI,但真正能"完全甩手"交给 AI 的任务只有 0-20%。这说明,AI 更像是一个时刻在线的合作伙伴。要用好它,你需要精心设置、巧妙提示(Prompting)、主动监督,并运用人类的判断力,尤其是在那些高风险的工作中。这份报告梳理了 2026 年将定义智能体编程(Agentic Coding)的八大趋势。这些预测分为三类:1)重塑开发方式的基础趋势 2)扩展 AI 能力的能力趋势 3)以及影响业务成果的影响趋势。用过 Claude Code 或 Cursor 的人应该都有体感:AI 确实能帮你省很多事,但你不能撒手不管。它更像一个能力很强但需要你带方向的队友,不是一个可以完全信任的外包。软件开发正在向这样一个模式进化:人类专家专注于定义"什么问题值得解决",而 AI 负责处理"如何实现"的战术工作。【第一部分:基础趋势】【趋势 1:软件开发生命周期发生巨变】报告认为,这是自图形用户界面(GUI)诞生以来,人机交互最大的一次变革。!(imgs/software-development-life-cycle.png)回顾一下历史:从机器码到汇编,再到 C 语言和现代高级语言,每一次抽象层级的提升,都在缩小人类思维和机器执行之间的距离。2025 年,AI 改变了代码的编写方式;2026 年,这种转变将重塑整个开发流程和工程师角色。传统的软件开发生命周期(需求 → 设计 → 编码 → 测试 → 部署 → 审查)通常以"周"或"月"为单位。在 Agent 介入后,这些阶段还在,但周期被极度压缩到"小时"甚至"天"。Agent 负责实现代码、自动化测试和文档生成,监控反馈直接推动快速迭代。报告做了三个预测:第一,写代码、调试、维护这类"苦活累活"将主要交给 AI,工程师们把精力放在架构设计、系统设计这些更高层级的工作上。第二,工程师的角色从"写代码的人"变成"编排 Agent 写代码的人"。你要做的是评估 Agent 的产出,给方向,确保系统解决了正确的问题。第三,新员工入职一个陌生代码库的时间从几周缩短到几小时。这直接改变了公司对人才调配的思考方式。角色转变这一点我是有共鸣的。我自己用 Claude Code 的体验是:以前一个功能从想到做完,大部分时间花在写代码上;现在大部分时间花在想清楚要什么、怎么拆任务、怎么验收上。编码本身反而变成了最快的环节。报告还提到一个有意思的观察:Agent 接手实现工作后,工程师并没有被取代,反而变得更像"全栈工程师"。因为 AI 填补了知识空白,你现在可以跨前端、后端、数据库和基础设施工作,不再局限于自己最擅长的那一小块。以前需要跨团队协调数周的事情,现在几次专注的工作会话就能搞定。工程师们更倾向于把那些容易验证、定义清晰或重复性的任务交给 AI,而把高层设计和需要"品味"的决策留给自己。报告引用了一个案例:初创公司 Augment Code 用 Claude 帮工程师快速熟悉复杂的网络平台和数据库代码。某企业客户的 CTO 原本估计 4 到 8 个月才能完成的项目,用了 Augment Code 之后两周就搞定了。【第二部分:能力趋势】【趋势 2:从单个 Agent 进化为协同战队】目前大多数人用 Agent 的方式是:一个对话窗口,一个 Agent,线性处理任务。报告预测 2026 年会出现多 Agent 协同工作的模式,处理复杂度远超单个 Agent 能力上限的任务。具体来说,是一种多 Agent 层级架构:一个"指挥官 Agent"负责拆解任务、分配工作、合成结果、把控质量;下面挂着多个"专家 Agent",分别负责架构设计、代码实现、测试验证、审查文档。这种并行处理的好处不只是快,还能通过不同视角发现盲点。不过这需要新技能:任务拆解、Agent 专业化和协调协议,以及能显示多个并发 Agent 会话状态的开发环境。!(imgs/coding-agent-architectures.png)劳动力管理平台 Fountain 的案例很有说服力:他们用 Claude 构建了分层多 Agent 系统,一个"Copilot"作为指挥官,协调负责筛选候选人、生成文档和情感分析的子 Agent。结果是筛选速度提升 50%,入职速度提升 40%,候选人转化率翻倍。某物流客户原本需要一周多才能招满一个新运营中心的人,现在不到 72 小时。我觉得多 Agent 协同是 2026 年最值得关注的方向之一。单个 Agent 的上下文窗口(context window)有限,能处理的复杂度也有天花板。把任务拆分给多个 Agent 并行处理,再合成结果,理论上能突破这个瓶颈。【趋势 3:长时间运行的 Agent 构建完整系统】早期 Agent 只能处理几分钟内搞定的小任务:修个 bug、写个函数。到 2025 年底,已经能花几个小时生成完整的功能集。报告预测 2026 年,Agent 将能连续工作数天,在极少人工干预下构建整个应用和系统。三个预测:1)Agent 的任务时限从分钟级扩展到天或周。它们将能自主规划、迭代,从失败中恢复,在复杂项目中保持状态一致。2)技术债务清理。那些因为没时间处理而积压多年的技术债(为了短期速度而牺牲代码质量,后续必须还的"债"),现在可以交给 Agent 系统性地消除。3)创业加速。创业者可以在几天内将想法转化为已部署的应用。乐天(Rakuten)的案例让人印象深刻:工程师让 Claude Code 在 vLLM 这个 1250 万行代码的大型开源库中实现一种特定的向量提取方法。Claude Code 自主工作了 7 个小时,一次运行就完成了全部工作,数值准确率达到参考方法的 99.9%。这个案例的价值在于它展示了 Agent 在真实的大型代码库中长时间自主工作的能力。1250 万行代码,7 小时自主运行,99.9% 准确率,这在一年前是不可想象的。技术债清理这一点对很多团队来说可能最有实际意义。谁的代码库里没有一堆"早就该重构但一直没人动"的东西?以前没人愿意碰是因为投入产出比太低,现在交给 Agent 去做,成本大幅降低。【趋势 4:人类监督通过智能协作实现规模化】2026 年最有价值的能力进步,也许是 Agent 学会了什么时候该求助。这不是要把人类踢出局,而是让人的注意力花在刀刃上。三个预测:1)Agent 质量控制标准化。组织用 AI Agent 来审查大规模的 AI 生成代码,分析安全漏洞和架构一致性。这个工作量靠人工是不可能覆盖的。2)Agent 学会"举手提问"。聪明的 Agent 不会盲目尝试所有事情,它们会识别出需要人类判断的情况,标记不确定性,把有潜在商业影响的决策交给人类。3)从"全盘审查"到"重点审查"。人类不再需要盯着每一行代码,而是处理那些真正新颖的、边界案例和战略决策。报告提到了一个有趣的"协作悖论":虽然 AI 承担了大量工作,但工程师能"完全放权"的部分却很少。原因是越到概念复杂或依赖设计的任务,工程师越倾向于自己掌控或跟 AI 紧密协作,而不是完全甩手。一位 Anthropic 工程师说得很到位:"我主要在我知道答案应该是什么样子的情况下使用 AI。这种判断力是我通过'笨办法'做软件工程积累出来的。"这句话点出了一个容易被忽略的事实:你越有经验,越能从 AI 协作中获益。因为你知道什么是好的、什么是对的,才能有效地指导和验收 Agent 的工作。AI 放大的是你已有的能力,而不是凭空创造能力。印度金融科技平台 CRED 的案例也印证了这一点:他们在整个开发生命周期中使用了 Claude Code,执行速度翻倍。但这不是通过取消人类参与实现的,而是把开发者从低价值工作中解放出来,转向更高价值的工作。【趋势 5:Agent 编程扩展到新领域和新用户】2026 年,编程不再是专业软件工程师的专利。三个预测:1)语言障碍消失。支持范围扩展到 COBOL、Fortran 等冷门或遗留语言,维护老旧系统不再是噩梦。2)编程民主化。网络安全、运营、设计和数据科学领域的非传统开发人员,通过新界面使用 Agent 编程。Anthropic 自己推出的 Cowork 就是面向非开发者的文件和任务管理自动化工具。3)人人都更"全栈"。安全团队用它分析陌生代码,研究团队用它构建前端可视化,非技术员工用它调试网络问题或做数据分析。"会写代码的人"和"不会写代码的人"之间的界限正在变模糊。法律科技平台 Legora 的案例:他们利用 Claude 的指令遵循能力,让不懂编程的律师也能创建复杂的自动化工作流,不需要工程团队介入。这个趋势我在身边已经看到了。越来越多的产品经理、设计师、运营人员开始用 Cursor 或 Claude Code 做一些简单的工具和自动化脚本。以前这些需求要么排队等开发排期,要么就一直搁置。现在他们自己就能搞定,虽然不够精致,但能用就行。【第三部分:影响趋势】【趋势 6:生产力收益重塑软件开发经济学】报告提出了一个"三大乘数效应":Agent 能力提升、编排方式改进、人类经验更好地发挥,这三者叠加产生的是阶跃式提升,而不是线性增长。因为开发周期从周变天,很多以前觉得"不划算"的项目现在变得可行了。Anthropic 内部研究发现了一个有意思的模式:工程师报告说每个任务的花费时间减少了,但产出量的增加幅度更大。也就是说,AI 带来的生产力提升主要体现在产出量上,发布更多功能、修更多 bug、做更多实验,而不仅仅是做同样的事更快。其中大约 27% 的 AI 辅助工作,是那些如果没有 AI 就根本不会做的事情:扩展项目、做个交互式仪表盘之类的"有了更好但没有也行"的工具、试探性的实验。工程师还报告说会顺手修更多"小毛病"(papercuts),那些以前优先级太低不值得专门花时间但又影响体验的问题。通信巨头 TELUS 创建了超过 13000 个定制 AI 解决方案,工程代码发布速度提升 30%,累计节省超过 50 万小时。27% 这个数字很有意思。它意味着 AI 不只是帮你更快地做原来的事,还让你能做以前根本不会去做的事。这才是真正的生产力释放。【趋势 7:非技术用例在组织内扩展】销售、市场、法律和运营团队开始用 Agent 编程解决自己的问题。最了解业务痛点的专家不再需要排队等 IT 部门排期,他们可以直接构建解决方案。那些不值得占用工程师时间的边缘问题得到解决,手动流程被自动化。Anthropic 自己的法律团队就是个例子:他们用 Claude 构建了自动化合同修订和内容审查的工作流,把营销审查周期从 2-3 天缩短到 24 小时。一位没有编程经验的律师构建了自助工具,在问题进入律师队列前就进行分流。Zapier 更夸张,整个公司 89% 的员工都在用 AI,内部部署了 800 多个 AI Agent。设计团队用 Claude 在客户访谈中实时生成设计原型,以前需要几周才能出的东西,现在当场就能看到。【趋势 8:安全的双刃剑】Agent 编程在强化安全防御的同时,也可能被攻击者利用。好的一面:有了 AI 辅助,任何工程师都能进行深度安全审查和系统加固,相当于人人都有了安全专家级别的能力。坏的一面:攻击者也会利用 Agent 扩大攻击规模。为了应对机器速度的攻击,自动化的 Agent 防御系统将变得必要,实现毫秒级的检测和响应。报告的建议是:安全架构必须在设计之初就嵌入,而不是事后补丁。提前做好准备的团队,在面对使用同样技术的攻击者时会有优势。【最后】这份报告读下来,最核心的一点是:AI 不是来取代开发者的,而是在改变开发者做什么。以前 80% 的时间花在实现上,20% 花在思考上;现在反过来了。你需要花更多时间想清楚要做什么、怎么拆解、怎么验收,然后把实现交给 Agent。对个人来说,最值得投资的能力是:系统设计能力、任务拆解能力、以及评估代码质量的眼光。这些"老功夫"在 Agent 时代反而更值钱了。对团队来说,2026 年谁先把 Agent 编程从"个人工具"变成"组织能力",谁就能拉开差距。那些还在观望的,会发现游戏规则已经变了。

6. > 不出三年,软件工程专业,大概就是新的五笔打字培训班。说这种话的人,大概率不真正理解“软件工程”这四个字里,“工程”两个字的含量。工程是把一件模糊的、不确定的事情,通过有计划、有步骤的方法,靠谱地做成。软件工程就是把这套思路用在软件开发上,需求怎么理清、架构怎么设计、质量怎么保证、团队怎么协作、项目怎么推进,这是一整套系统性的能力。AI 现在确实强,但它强在软件生命周期里的编码环节(还有很大进步空间),或者说某几个具体阶段。但编码只是软件工程的一个环节,AI 并不能主导整个生命周期,从需求分析、系统设计、技术决策、团队管理到长期维护,这些事情远不是写代码快就能解决的。至少在相当长的时间内都不行。把软件工程类比成五笔打字,这是把“编程”和“软件工程”搞混了。这就好比说有了 3D 打印,建筑学专业就是新的砌墙培训班。能快速盖出一面墙,和设计一栋安全、合理、可维护的建筑,完全是两回事。

7. vibe coding 完项目后,跑这个 Prompt 做安全审计。最近 AI 生成的代码安全漏洞频出——API key 硬编码在代码里、SQL 注入没处理、认证逻辑靠 AI 随手写的……很多人 vibe coding 完直接上线,根本没做安全检查。网友milesdeutscher分享了一个 Claude Code 专用的代码库深度安全审计 Prompt,值得收藏!Conduct a thorough security audit of this codebase. Check for:1. Exposed API keys, secrets, or credentials hardcoded anywhere2. SQL injection vulnerabilities3. Authentication and authorization flaws4. Insecure direct object references5. Missing input validation or sanitization6. Sensitive data exposure in logs or error messages7. Insecure dependencies or outdated packages8. CORS misconfigurations9. XSS vulnerabilities10. Any critical security issues that could lead to data breachesFor each issue found, explain: what it is, where it is, why it's dangerous, and how to fix it. Prioritize by severity.跑完之后 Claude 会逐条给你列出问题、说明风险等级、给出修复方法。几个值得注意的地方:1. API key 泄露是最常见问题。 vibe coding 时 AI 经常把 key 直接写进代码,或者写进被 commit 的配置文件。很多人根本没意识到这件事。2. 认证逻辑最容易出错。 "帮我加一个登录功能"——AI 给出的实现不一定符合你实际的安全要求,要单独 review。3. 这不是一次就够的。 每次加了新功能后都应该跑一遍,而不是发布前跑一次交差。vibe coding 本身没问题,但安全审计这步不能跳过。#HOW I AI# #程序员#

8. AI 编程时代,最稀缺的不是提示词,而是软件工程

9. 团队用vibe coding后,代码审查效率反而下降了,ai 为什么还不能替代初级程序员吗?

10. 危及10亿人的全球高危漏洞。 被360漏洞挖掘智能体自动扫描发现!#大有学问 #红衣聊AI #智能体 #AI工具

11. OpenAI推出的GPT-5.2-Codex模型聚焦专业软件工程与防御性网络安全的智能编程模型,在编码性能、安全防护能力和长周期任务处理三大核心领域实现突破性进展,标志着AI从辅助工具向专业伙伴的进阶又迈出关键一步。以往AI编程工具常因上下文记忆限制,在百万行级代码重构、跨模块系统迁移等长期任务中断档。而该模型搭载的上下文压缩技术,能智能保留关键任务信息,即便连续处理超过24小时的复杂开发任务,也能完整衔接全链路逻辑。在权威的SWE-Bench Pro基准测试中,其工程任务完成率较前代提升47%,错误修复效率更是提高62%,让原本需要数月的核心系统重构工作大幅缩短周期。它大幅强化了Windows 10/11原生环境下的编码可靠性,在Terminal-Bench 2.0终端测试中,编译成功率达91%,较前代提升33个百分点。更值得一提的是其升级的视觉理解能力,能直接解析技术架构图、UI设计稿,将设计原型转化为可运行代码的准确率提升至89%,让看图写代码从概念落地为实用功能,显著降低开发门槛。此前已有安全研究员借助前代模型,成功发现React框架中的三个高危漏洞,而新版模型的安全分析能力更上一层楼。它能模拟攻击者思维,在开发阶段自动识别92%的常见安全风险,零日漏洞发现效率达到资深安全工程师的1.7倍,可自主完成测试环境搭建、攻击面分析、模糊测试等标准防御流程,将漏洞验证周期从数周压缩至数天。尽管该模型未达到内部定义的高风险等级,但仍推出可信访问试点计划,仅向经过严格审查的安全专业人士开放高权限功能,确保技术仅用于防御性安全工作。目前,所有ChatGPT付费用户已可直接体验相关功能,API接口也将在未来几周逐步开放。#科技先锋官##AI创造营##AI创作热点##AI生活指南# 种斌Marco的微博视频

12. Claude Security开放公测:Opus 4.7加持,一键实现代码漏洞扫描与补丁生成

13. 雷军回应小米汽车「好看第一」与「安全至上」不冲突,如何理解这一设计理念?

14. 2026年AI全景预测:迈向百亿智能体时代的20个发展趋势。 #大咖观察 #人工智能 #红衣聊AI #智能体 #AI时代

15. 最近,360安全团队发现了OpenClaw一个高危漏洞。 OpenClaw创始人随后邮件确认了这个漏洞。而发现这个漏洞的,不是某个安全专家,而是一个我们刚发布不到一周的智能体。#openclaw #网络安全 #红衣聊AI #安全漏洞

16. 来了~NanoClaw:4000行代码的容器化 AI Agent Gavriel Cohen 用 Claude Code 开发,核心只有 4000 行。 对比 OpenClaw 的 40 万行,设计理念完全不同: 1. 隔离方式 - OpenClaw:应用层限制,Agent 和所有接入服务在同一进程里 - NanoClaw:每个 Agent 跑独立容器,只能访问被授权的最小数据集 举个例子:接了你 飞书某个群,Agent 只能看这个群,其他消息完全隔离。 2. 代码量即安全边界 40 万行没人真正审计过。4000 行,你或者 AI 都能读懂架构和安全模型。 Karpathy 点评:"装得进我脑子,也装得进 AI 的上下文——可管理、可审计、灵活。" 功能比 OpenClaw 少很多,还很早期,但安全模型更扎实。 🔑 三个关键点 ① 容器隔离比应用层规则可靠,权限最小化才是正确姿势 ② 代码量直接影响可审计性,越小越好理解 ③ Agent 安全问题才刚开始被认真对待 GitHub:github.com/qwibitai/nanoclaw #HOW I AI# #程序员#

17. 怎么验证AI生成的单元测试是真的在测东西,而不是形式上通过?

18. 过去十年,大家一直在说AI会改变编程。 但现在看,真正被改变的,可能不是“写代码”,而是“审代码”。如果未来AI写代码、审代码都变成了常态,程序员最核心的能力到底是什么呢?#大有学问 #红衣聊AI #anthropic #人工智能 #程序员

19. AI 不是不能用于物联网开发,而是不能用传统互联网软件的方式粗放使用。#AI 不是不能用于物联网开发#在网页、后台、普通应用里,AI 生成一段不完美代码,最多是线上 bug 或性能问题。但在物联网里,代码连接真实硬件、真实现场和真实设备网络。所以 AI 生成代码的风险会被放大。它可能不是一个 bug,而是一次系统性故障。不是一个用户受影响,而是几千台设备同时受影响。不是简单改代码,而是要远程升级固件、排查硬件差异、修复数据一致性。AI 给物联网带来的不是单纯提效,而是“提效与风险同步放大”。真正成熟的 AIoT 开发,不是让 AI 替代工程纪律,而是要在更严格的架构约束、代码审查、硬件边界和运行监控下使用 AI。AI 可以加速物联网开发,但如果没有工程约束,它也会加速技术债务的积累;在工业物联网里,最快的代码,不一定是最安全的代码。

20. Anthropic 推出 Code Review:用一组 AI Agent 帮你做代码审查 Anthropic 今天发布了 Claude Code 的新功能 Code Review,针对 GitHub 上的每个 Pull Request(代码合并请求)自动派出一组 AI Agent 进行深度审查,目前面向 Team 和 Enterprise 计划用户开放研究预览。 (注意个人用户还用不了) 这个功能的背景:过去一年,Anthropic 内部工程师的代码产出增长了 200%,代码审查成了瓶颈。他们发现客户也面临同样的问题,开发者疲于应付,很多 PR 只是被快速扫一眼,而非认真审读。 Code Review 的工作方式是:当 PR 提交后,系统自动派出多个 Agent 并行查找 bug,交叉验证以过滤误报,再按严重程度排序。 最终在 PR 上生成一条汇总评论,外加逐行的具体标注。大型复杂的 PR 会分配更多 Agent 做更深的审查,小改动则轻量处理,平均审查时间约 20 分钟。 Anthropic 自己已经内部使用了几个月。使用前,只有 16% 的 PR 能收到实质性审查意见;使用后,这个比例升到了 54%。 在超过 1000 行改动的大 PR 中,84% 会被发现问题,平均每个 PR 找出 7.5 个问题。工程师对结果的认可度很高,不到 1% 的发现被标记为误报。 他们举了个例子:一个看起来很常规的单行改动,实际上会导致生产环境的身份认证功能失效。Code Review 把它标记为严重问题,提交代码的工程师事后承认自己不会注意到这个问题。 不过这个功能不便宜。它按 token 用量计费,每次审查平均花费 15 到 25 美元,随 PR 规模浮动。管理员可以设置月度预算上限、选择启用的仓库,也有分析看板追踪使用情况。 值得注意的是,Code Review 不会自动批准 PR,最终是否合并仍由人决定。它的定位是补上人工审查的盲区,而非取代人类审查者。 Anthropic 此前已有开源的 Claude Code GitHub Action 做轻量审查,这次的 Code Review 是更重量级、也更贵的选项。 http://t.cn/AXVXCz6o

21. 读Anthropic年度报告:2026年,程序员的工作方式正在被彻底重塑。最近读到 Anthropic 发布的《2026 Agentic Coding Trends Report》,这是一份关于 AI 编程代理趋势的年度预测报告。作为开发 Claude 的公司,他们对 AI 编程的观察和预测很有参考价值。读完之后,有不少让人眼前一亮的观点,也有一些值得每个人认真思考的东西。1、从写代码到指挥 AI 写代码报告开篇就点明了一个核心判断:2025 年,AI 编程代理从实验性工具变成了能交付真实功能的生产系统。2026 年,这种变化会进一步加速,最显著的转变是工程师的角色定位。以前,做软件工程师意味着写代码。虽然这个岗位一直涉及很多其他技能,但写代码始终是核心。现在不一样了,做软件工程师越来越意味着编排 AI 代理写代码、评估它们的输出、提供战略方向,以及确保整个系统解决的是正确的问题。换句话说,工程师正在从实现者变成指挥家。这个转变听起来很抽象,但报告里有个细节很具体:传统的入职培训,让一个新人熟悉一个复杂代码库,通常需要几周时间。现在,借助 AI 的帮助,这个时间可以压缩到几小时。一家叫 Augment Code 的公司,他们的企业客户用 Claude 驱动的工具,把原本预计 4 到 8 个月的项目,两周就完成了。时间压缩带来的连锁反应很大。以前因为入职成本高,公司很难灵活调配人员。现在可以按需调配工程师到需要深度代码知识的任务上,人员配置变得更加动态。2、从单兵作战到多代理协同报告预测的第二个重要趋势是:单个 AI 代理会进化成协调配合的代理团队。这是什么意思呢?以前用 AI 写代码,基本上是一问一答的模式,你提一个需求,AI 给你一段代码。现在开始出现更复杂的玩法:一个主代理负责协调,下面有专门筛选、专门生成文档、专门做情感分析的子代理,各司其职,并行工作。报告举了一个例子,Fountain 是一个做一线员工管理的平台,他们用这种多代理架构,把筛选速度提升了 50%,入职速度提升了 40%,候选人转化率翻了一倍。有一个物流客户,以前给新履约中心配齐人员需要一周以上,现在 72 小时就能搞定。多个代理协同工作,每个代理有自己专注的领域和独立的上下文窗口,然后由一个协调者把结果整合起来。这种架构能处理的任务复杂度,比单个代理高出一个量级。3、从几分钟到几天:长时间运行的代理早期的 AI 编程助手,处理的是一次性的小任务:修个 bug,写个函数,生成个测试用例。几分钟就完事了。报告预测,2026 年代理能连续工作几天,构建完整的应用和系统,中间只需要人在关键决策点做一些监督。这不是畅想,报告里提到一个真实案例。Anthropic 的工程师让 Claude Code 实现一个复杂的技术任务:在 vLLM 这个有 1250 万行代码的开源库里,实现一个特定的激活向量提取方法。Claude Code 自主工作了 7 个小时,一次性完成了整个任务,数值精度达到了 99.9%。当代理能连续工作这么长时间,软件开发的经济学就变了。以前因为没人有时间处理而积压多年的技术债务,可以让代理系统性地清理。以前觉得不划算的项目,现在变得可行了。创业者从想法到部署应用,可能只需要几天而不是几个月。4、人机协作的真实面貌报告里有一组数据特别有意思:开发者在大约 60% 的工作中使用 AI,但他们能完全委托给 AI 的任务,只占 0 到 20%。这两个数字看起来矛盾,其实不然。它揭示了人机协作的真实面貌:AI 是一个持续的协作者,但有效使用它需要周到的准备、主动的监督、输出的验证,以及人类的判断。尤其是高风险的工作,更需要人的把关。工程师们描述了他们是怎么判断哪些任务可以交给 AI 的。通常是那些容易验证的任务,比如能快速检查对不对的;或者是低风险的任务,比如写个小脚本追踪一个 bug。越是概念上复杂、越是依赖设计判断的任务,越是要自己来做,或者和 AI 协作着做,而不是完全交出去。这里面有一句话说得特别好:我主要在那些我知道答案应该是什么样子的情况下使用 AI。而我之所以有这种判断能力,是因为我用笨办法做过足够多的软件工程。换句话说,AI 放大的是你已有的能力,而不是凭空给你创造能力。你得先有判断力,AI 才能帮你提效。5、每个人都在变得更全栈报告观察到一个有趣的现象:工程师正在变得更全栈。以前你可能只懂前端,或者只懂后端。现在借助 AI,你可以在自己不太熟悉的领域也能有效工作。AI 填补你的知识空白,你提供监督和方向。前端工程师可以处理数据库问题,后端工程师可以调整界面布局,安全团队可以分析不熟悉的代码,研究团队可以给数据做可视化。这种能力扩展带来更紧密的反馈循环和更快的学习。以前需要跨团队协调好几周的任务,现在可能变成一个人集中工作几个小时就能搞定。更有意思的是,这种扩展不局限于技术人员。报告提到,编程能力正在向非技术岗位扩散。销售、市场、法务、运营团队,开始有能力自己自动化工作流程、搭建小工具,不需要等工程团队排期。Anthropic 自己的法务团队就是例子。一个没有编程经验的律师,用 Claude Code 搭建了自助服务工具,在法务请求进入正式队列之前就做好分流。市场内容审核的周转时间,从两三天缩短到了 24 小时。以前不值得工程团队花时间的问题,现在能被解决了。实验性的工作流程,现在可以轻松尝试。手动流程,现在可以自动化。6、生产力提升的真相报告里还有一个洞察很重要:AI 带来的生产力提升,主要体现在产出量的增加,而不仅仅是速度变快。工程师们报告说,每类任务花的时间减少了,但产出量大幅增加了。更多功能上线,更多 bug 被修复,更多实验被执行。特别值得注意的是,大约 27% 的 AI 辅助工作,是原本根本不会去做的任务。比如扩展项目规模、搭建锦上添花的工具(像交互式仪表盘)、做一些人工成本太高不划算的探索性工作。工程师们说,他们现在会修复更多小问题,那些能改善体验但平时总是被往后排的东西,因为 AI 让处理它们变得可行了。Twilio 的数据很能说明问题:他们的团队创建了超过 13000 个定制 AI 解决方案,工程代码交付速度提升了 30%,总共节省了超过 50 万小时,平均每次 AI 交互节省 40 分钟。7、安全:双刃剑报告最后提到了安全问题,这是一把双刃剑。好的一面是,安全知识正在民主化。以前安全审查、加固、监控需要专业知识,现在任何工程师都可以借助 AI 来做。从一开始就把安全融入产品变得更容易了。坏的一面是,同样的能力也能帮助攻击者扩大攻击规模。防守方能用的工具,进攻方也能用。报告的建议是:从一开始就把安全融入设计的团队,会比那些后期才考虑安全的团队,更有能力应对同样使用 AI 的对手。8、2026 年的优先事项报告最后总结了 2026 年值得关注的四个领域:第一,掌握多代理协调,处理单代理系统无法应对的复杂度。第二,通过 AI 自动审查系统扩展人机监督,把人的注意力集中在最重要的地方。第三,把代理编码扩展到工程团队之外,赋能各部门的领域专家。第四,从最早期阶段就把安全架构融入代理系统设计。9、写在最后读完这份报告,最大的感受是:变化来得比想象中快。2025 年,大家还在讨论 AI 能不能真的写代码。2026 年,话题已经变成了怎么协调多个 AI 代理一起工作、怎么让 AI 连续工作几天构建完整系统。对于技术从业者来说,角色转型已经不是未来时,而是进行时。写代码的能力依然重要,但更重要的是判断力、架构能力、问题分解能力,以及协调 AI 完成复杂任务的能力。对于非技术人员来说,编程能力的门槛正在降低。以前觉得遥不可及的自动化和工具搭建,现在可能动动手就能实现。这既是机会,也是挑战。报告里有句话说得好:目标不是把人从循环中移除,而是让人的专业能力用在最重要的地方。不管你是什么岗位,这句话都值得好好琢磨。#科技先锋官##HOW I AI#

22. 看到贾扬清发的一篇推文,在 X 上,他是这么说的:“软件工程师”从未被定义为“写代码的人”,“程序员”才是。在过去的 10 年里,我们不再只关注代码,而是更看重结果。这是一个持续的趋势。所以,软件工程师并没有走向没落,反而正处于飞速发展的阶段。同时他还在评论区进一步解释,说:程序员负责编写实际代码。而软件工程师(SWE)的工作则是将业务需求转化为技术术语,设计模块和流程,并确保交付质量。编码只是实现这一目标的手段。因此有了 AI 编程工具,软件工程师实际上会变得更加强大。而且,贾扬清还附带了一张配图,是程序员与软件工程师的趋势图,看图表,大概是在 2018 年左右软件工程师的数量正式超越程序员的数量。不知道大家怎么看?但是,无独有偶,昨天我写了一篇文章《前阿里 P10 毕玄的一张聊天截图火了》,前阿里 P10 的毕玄说:随着 AI Coding 的发展,公司决定以后不再按技术栈划分技术岗位了,公司所有的技术岗统一称为 Agent 工程师。在工作安排上相应的后续也就不再按照技术栈来安排,而是完全根据产品、项目任务来安排,这意味着以后一项工作里可能涉及各种技术领域,对于不同的领域,需要自己去学习,要么问同事,要么问 AI。其实,这两个观点不谋而合,说白了,他们都在讲同一件事:写代码本身,正在变得越来越不值钱。真正值钱的,是解决问题的能力。贾扬清把人分成了“程序员”和“软件工程师”。程序员是埋头写代码的,而软件工程师是负责把业务需求变成技术方案,设计系统,保证最后能交付的人。AI 编程工具的出现,让“程序员”的工作被大大简化了,但“软件工程师”反而因为有了强大的工具而变得更厉害。毕玄说的“Agent 工程师”更进一步。他认为以后连技术栈都不重要了,前端后端数据库,你可能都要懂一点,因为 AI 能帮你搞定大部分具体实现。你的核心任务,是作为一个项目的主导者,调动 AI 这个“超级员工”,去完成一个完整的业务目标。你看,一个是“软件工程师”,一个是“Agent 工程师”,叫法不同,但内核是一样的。都是在强调,未来的技术人员,价值不再是“我会用什么工具”,而是“我能解决什么问题”。为什么现在大家都在讨论这个?道理很简单,因为 AI 太能干了。以前,一个项目需要前端、后端、测试、运维,分工明确,因为每个环节都很复杂,一个人很难搞定全部。分工是为了提高效率。现在,AI 来了,它能写前端页面,能写后端接口,能写测试用例,甚至还能帮你部署。以前需要一个团队干的活,现在一个“工程师”带着 AI 就能干。这时候,公司最需要什么样的人?肯定不再是那个只会拧某一颗特定螺丝的“程序员”了。公司需要的是那个能画出整台机器图纸,并且能指挥一堆 AI 机器人把机器造出来、跑起来的“总设计师”,也就是“软件工程师”或者“Agent 工程师”。这对我们普通技术人意味着什么?我觉得有几点特别重要。第一,别再死磕某一个技术栈了。以前我们总担心“我的技术会不会过时”,现在可能要换个思路,你的“解决问题的能力”会不会过时。你应该去了解一个项目从头到尾的整个链路,前端怎么和后端交互,数据怎么存储,服务怎么部署。不求样样精通,但至少要能看懂,能和 AI 对话。第二,把 AI 当成你的副驾驶,而不是你的对手。你要学会怎么给 AI 提需求,怎么审查 AI 写的代码,怎么让 AI 帮你提高效率。你和 AI 的关系,就像一个项目经理和他的团队成员。你的价值在于你的经验、判断力和大局观。第三,多往业务靠拢。多去理解你做的这个功能,到底解决了用户的什么问题,为公司带来了什么价值。你越懂业务,就越能提出好的技术方案,也就越不容易被替代。只会听需求、写代码的“工具人”,未来会非常危险。所以,贾扬清说“程序员消亡,但软件工程师永存”,我深以为然。这其实不是一个悲观的预测,反而是一个乐观的信号。它告诉我们,重复、枯燥的编码工作会越来越少,而那些需要创造力、系统思维和工程智慧的工作会越来越多。对我们每个人来说,这既是挑战,也是一次巨大的机会,一次从“代码工人”转型为“问题解决专家”的机会。当然了,昨天的那篇文章火了,评论区都炸了,都在说一件事:想象的太美好了,感觉毕玄肯定不会写代码或者不在技术一线。我感觉大家讨论的也有道理,AI 写的代码现在确实有很多问题,比较难维护,不会复用,代码重复,冗余等等。这些问题都是现实存在的,但是,未来工程师的职责是架构设计,是统筹协调,是管理 AI ,这也肯定是趋势的,AI 毕竟在发展中,未来 AI 写代码的能力肯定会是越来越强的,这也是我们能够看得见的,可预测的。现在的 AI 确实很像一个虽然聪明但有点毛躁的“实习生”。他写代码速度飞快,但不懂复用,不考虑维护性,更没有架构意识。这时候,你作为“软件工程师”或者“Agent 工程师”,你的价值就体现出来了。你的工作不再是逐行去实现业务逻辑,而是:1、定义好框架和规范:你得告诉 AI,“我们这个项目要用什么样的设计模式,日志要怎么打,错误要怎么处理”。你制定规则,AI 在规则内干活。2、做好代码审查(Code Review):AI 生成的代码,你得能看懂,能判断出好坏。哪里有坑,哪里不合理,哪里需要重构,你得指出来,然后让 AI 去改,或者自己动手改。3、关注系统整体:AI 可能给你生成了 10 个独立的模块,每个都能跑,但它们之间的数据怎么同步?认证怎么统一?出问题了日志怎么追溯?这些系统性的问题,AI 不会主动告诉你,它只会等你问。而一个好的软件工程师,在动手之前就已经把这些问题想好了。所以,说 AI 立刻就能取代所有编码工作,确实是太乐观了。但反过来说,因为 AI 现在代码写得不好就完全否定它的价值,又太悲观了。正确的看法应该是,AI 把我们从繁琐的“编码”工作中解放出来,让我们能专注于更有价值的“工程”工作。工程师的价值,正在从“亲手把砖头码整齐”,变成“设计出宏伟的大厦蓝图,并监督施工队(AI)把楼盖好,保证质量”。说到底,未来衡量一个技术人价值的,不再是你写了多少行代码,而是你交付了多高质量的系统,解决了多复杂的业务问题。这个趋势,我觉得是不可逆的。不知道大家怎么看?#科技先锋官##HOW I AI#

23. 大家在使用AI编程时,更倾向于让AI一次次生成短小易读的代码,还是直接放手让AI写一大片?

24. 亚马逊将禁止初级工程师直接提交 AI 代码,如何评价这一举措?AI 提效与工程质量如何平衡?

25. 瞒着班主任开公司?高三生雇了个“赛博团队”!

26. 龙虾时代,人和AI的关系已经改变了... #大有学问 #红衣聊AI #openclaw #养龙虾 #AI工具

27. Claude新模型4.6:开箱即挖500个0day漏洞,源代码审计即将颠覆

28. 新手如何用Claude Code实现代码自动审查和批量文件处理?

29. 在线代码评审经常面临一个难题:Claude Code 每次都要重读整个代码库,消耗大量计算资源和时间,效率低下。code-review-graph 这个开源项目为 Claude Code 构建了本地代码知识图,自动解析你的代码库结构,精准定位改动影响范围,实现只读“关键文件”,大幅减少无用令牌消耗。主要功能:- 基于 Tree-sitter,支持12种语言(包括Python、TypeScript、Java、Go等);- 增量更新代码图,文件保存或 Git 提交后2秒内完成重解析;- “爆炸半径”分析,精准追踪受影响代码和测试,避免全面扫描;- 支持语义搜索、交互式可视化代码依赖图;- 本地存储,无需云端依赖,数据安全放心;- 实现代码审查时令牌消耗平均降低6.8倍,日常编码任务最高可达49倍。使用方式也很简单:```pip install code-review-graphcode-review-graph install```然后打开项目告诉 Claude 构建图即可。GitHub:github.com/tirth8205/code-review-graph它帮你从海量代码中精准提取精华,让AI读代码更快更省心,推荐给所有需要AI辅助审查和开发的程序员朋友!#代码评审# #AI开发利器# #开源工具#

30. 只用一个大模型审代码已经过时。现在,开三个Cursor窗口,分别用Gemini 3.0 Pro、Claude Opus 4.5和Codex 5.1 High Pro,分别审查代码库并生成详尽的Markdown报告。然后让每个模型阅读另外两个的报告,最后用Opus 4.5进行步骤化的统一重构。流程结束,代码质量显著提升。为什么不用单一最强的Codex 5.1?即使是“王者”也需要智囊团。不同模型视角互补,避免盲点,提升审查深度。过往“凭感觉写代码”的时代一去不复返,AI协作正成为软件进化的核心动力。虽然有人担心多模型审查会带来冲突和额外复杂度,实际操作中可以根据目标选用最适合的模型: - Opus 4.5:通用且擅长理解新代码库 - Gemini 3.0:前端和UI表现卓越 - Codex 5.1:后端逻辑推理无敌 批判性的多模型交叉验证,相当于三位资深工程师各抒己见,最终汇聚成最佳方案。人类设计流程和决策策略,才是发挥这些AI最大效能的关键。这不仅仅是工具升级,更是开发范式的变革。未来,单模型“孤军奋战”将被多模型“团队协作”取代,代码审查和重构将更加严谨、高效、可靠。我们不再是“单兵作战”,而是运营一个由智能体组成的开发团队。原文:x.com/vasuman/status/1996414648594161923思考:在AI驱动的开发生态中,如何设计有效的“模型协作机制”,成为人类开发者新的核心竞争力。技术的进步让我们重新定义“代码质量保障”的边界,也让软件工程进入了“智能共创”时代。

31. OWASP发布生成式AI安全治理检查清单,助力企业应对LLM风险

32. 【AI时代的百倍工程师:构建系统,而非生成代码】 Peter Steinberger 仅用 10 天就独自构建了当红工具 OpenClaw。这证明了一个事实:传说中的“百倍工程师”不再是一个神话,而是一种可复制的范式。 在 2026 年,真正的百倍工程师不再利用 AI 来写代码,而是利用 AI 来设计系统架构。 这种差距源于何处?当有些人能以惊人的速度交付产品时,大多数工程师却陷入了困境。数据显示,尽管 84% 的开发者都在使用 AI,且 41% 的代码由机器生成,但我们正面临一场质量危机。对 2.11 亿行 AI 生成代码的分析表明,缺陷率正在飙升,代码维护变得愈发艰难。 问题的根源在于,许多团队试图用旧的工作流来驾驭新工具。他们盲目接受 AI 生成的所有内容,将文本生成误认为是系统构建。 普通开发者与百倍工程师的分水岭,在于一个核心概念:主导权。 真正的百倍工程师不会将 AI 视为一位可以全权委托的资深开发者,而是将其视为需要严格约束的“力量倍增器”。人类依然牢牢掌控着架构、验证和系统约束,而 AI 则负责通过并行代理和后台工作来提升吞吐量。 这种思维转变至关重要:你不再是一个代码撰写者,而是智能体的架构师。 要实现这一点,你需要一套完全不同的技术栈。 仅仅依赖浏览器端的聊天模型已经不够了。顶尖高手的工作流包含五个独立层级: 首先是内循环的 AI 优先 IDE。无论是 Cursor、Windsurf 还是 VS Code,这是你的战术指挥中心,用于处理小规模编辑、样板代码重构和测试修复。 其次是终端优先的代码代理。这是你的主要战场。Claude Code 或其他 CLI 工具在这里处理繁重的任务,如长上下文的代码库分析和多文件重构。 第三是后台代理。这是真正的秘密武器。像 OpenAI Codex、Devin 这样的工具,就像远程初级开发者。当你睡觉或开会时,它们在异步处理诸如“修复所有 ESLint 警告”或“迁移废弃 API”之类的任务。 第四是通用聊天模型。它们用于高层次的推理:设计文档、系统探索、调试复杂日志以及挑战你自己的假设。 最后,但同样重要的是,AI 代码审查工具。这是你的安全网。Codium 或 GitHub Copilot Workspace 等工具会在人工审查前标记架构问题、安全风险和优化建议。让 AI 处理第一轮审查,关注风格、明显的 Bug 和测试覆盖率,从而让人类工程师腾出手来专注于系统级的核心问题。 真正的高手会将所有这些组件通过 MCP(模型上下文协议) 连接起来。MCP 就像系统的神经系统,将 AI 从一个简单的聊天机器人转变为一个能够直接作用于 Git、Linear、Slack、Sentry 和数据库的实际代理。工具配置被版本化并在团队中共享,每个人都拥有同一套神经系统。 在这种模式下,工作流变成了“指挥、剖析、委托”。你不再是多线程工作,而是在进行编排。 资深工程师 Boris Cherny 的做法极具代表性。他同时运行五个以上的 Claude Code 会话,每个会话都是一个独立的“员工”,分别负责实现功能、编写文档、处理数据库迁移或重构模块。他的工作变成了一种简单的循环:定义框架、切割任务、分配给代理、最后做决策。 这种模式要求我们必须建立持久化的上下文。 新手寻找完美的提示词,而高手构建持久化的上下文。在代码库根目录维护一个 `claude.md` 文件,这是团队的活文档,记录了架构规则、命名约定、安全策略以及过往的错误教训。 当进行代码审查时,他们会强制让 AI 将新学到的经验反写回这个文件。这是一种“复利工程”,系统每周都会变聪明,而无需人工记忆。 在执行层面,最大的误区是让 AI 立即开始写代码。 最有效的模式是先规划,后执行。几乎每一个严肃的会话都始于“计划模式”。首先明确非协商条款:安全要求、延迟预算、成本上限。让 AI 列出所有边缘情况,并提出几种架构方案及其权衡。只有当你对计划满意后,才切换到执行模式。 这种“两次测量,一次切割”的方法,是精英用户能够让代理高度自治运行且不失控的关键。计划就是契约。 + 验证是不可妥协的底线。 如果没有严格的审查和测试循环,AI 辅助编程只会增加技术债。生产力的提升会在几个月内随着代码库变得不可维护而烟消云散。 必须建立具体的验证模式:测试先行,先让 AI 列出所有可能破坏函数的边缘情况并编写基于属性的测试,然后人工审查这些测试。同时实施“双重审查”机制,人类负责架构适配性和安全性,AI 子代理负责风格一致性和边界条件覆盖。 后台代理只应在受保护的沙盒分支中工作,且必须通过 CI 门禁。 这也是为什么必须坚持可靠性优于炫技。 比起那些 AI 建议的复杂新库,无聊且经过充分测试的原生 API 往往是更好的选择。AI 倾向于局部优化,而人类工程师必须思考系统级的后果。每当 AI 提出一个变更时,你必须问:在 10 倍负载下会发生什么?峰值负载的成本是多少? 如果你能做到这一切,你就不再是在“用 AI 写代码”,而是在围绕你的代码库构建一个分布式智能系统。 这就是顶尖高手在 2026 年正在做的事情。他们并不更擅长写提示词,他们更擅长理解一个道理:百倍工程师的核心一直是做更少的事,但做得更关键。 AI 只是将你需要亲力亲为的“更少”的部分,进一步压缩了。 如果你想从明天开始改变,请在你的主代码库根目录创建一个 `claude.md` 文件。添加三个部分:架构规则、已知错误以及约束条件。每次代码审查后,如果 AI 犯了错,就更新这个文件。 构建系统,主导结果,让代理去倍增其余的部分。 x.com/rohit4verse/status/2020501497377968397

33. Haider分享了一个正在发生的开发变革:他80-90%的代码由AI生成,而他负责设计、拆解任务、审查和优化,这让他的效率提升了10倍。AI不再是简单的“实习生”,而是如同一位经验丰富的资深工程师,甚至连架构设计都开始被部分AI承担。这个趋势引发了很多思考:1. 人类开发者的角色正在转变——从编码者变成架构师和审核者。写代码的定义正在从“敲代码”转向“高效编辑”和“系统设计”。2. AI生成代码速度极快,甚至可以用语音操作,开发流程因此大幅加速。3. 代码质量和系统安全依然需要人类把关,审核周期成了最关键的环节。4. 持续创新将成为公司在AI时代的唯一护城河,传统的专利保护将变得无力。5. 未来架构设计将由AI辅助甚至主导,这将彻底改变软件开发的格局,留给人类的空间更多是策略和商业层面的大局观。正如多位开发者所言,AI是永不疲倦的天才助手,极大释放了开发者的创造力和专注力。关闭AI辅助的开发环境会让人感到“戒断反应”,这显示了AI已经深度融入工作流。人类的真正竞争力在于“判断力”和“设计力”,而不是单纯写代码。这是一场从“代码劳动者”向“智能指挥官”的身份转变,技术的边界被重新定义,未来属于懂得驾驭AI、融会贯通创新的人。原文:x.com/slow_developer/status/1997554290689544281

34. OpenAI 内部残酷真相:只会写代码的工程师正在“消亡”,AI 正在制造无法跨越的阶层鸿沟

35. 把C++写的老项目重构成现代框架?给AI吧我不干了!

36. “一人公司”喊得响,核心系统不敢动,AI编程的错位在哪?#华为云码道 #龙虾 #AI智能体 #openclaw #AI

37. Anthropic发布万字长文:系统化评估 AI Agents 的工程方法

38. 有网友问 Claude Code 作者 Boris:如何有效审查 AI 生成的代码?Boris 给了 3 条经验技巧:1. 默认使用 Plan 模式。2. 给 Claude 提供一种验证其输出结果的方法,比如单元测试、Claude Chrome 扩展程序,或者 iOS/Android 模拟器。3. 使用 /code-review 来自动化大部分的代码审查工作。对 Claude 生成的代码保持与人类写的代码相同的标准。

39. “漏洞末日”警钟预警:AI批量发现黑客可利用的漏洞

40. RSAC 2026前瞻:当AI热潮遭遇安全运营

41. 51万行源码泄露!Claude Code 里面到底藏了什么?

42. 黄仁勋最新访谈:AI时代,软件没有价值了吗?很多企业在用AI上都踩了大坑#黄仁勋 #软件 #智能体 #Openclaw #龙虾

43. Harness Engineering(驭缰工程)是 OpenAI 在 2026 年 2 月提出的工程范式:工程师不再写代码,而是设计环境、明确意图、构建反馈回路,让 AI 智能体可靠地完成工作。传统工程:人类写代码 → 机器执行代码Harness Engineering:人类设计约束 → 智能体写代码 → 机器执行代码核心转变:工程师的产出从代码变成了约束系统——AGENTS.md、架构规则、自定义 linter、反馈回路。给大家推荐一个开源项目:Harness Engineering 学习指南,感兴趣的可以了解一下 Harness Engineering 。传送门:github.com/deusyu/harness-engineering#科技先锋官##How I AI#

44. 谷歌首次发现基于AI的0Day漏洞利用

45. 现在程序员的代码大多数都是用AI生成的,后面会成为屎山代码看不懂吗?

46. 【占比大幅提升!谷歌:公司内部75%的新代码已由AI生成】据媒体报道谷歌近日透露,目前公司内部新编写的代码中,已有75%由人工智能生成,随后再由人类工程师进行审核。这一比例近年来持续攀升。截至2024年10月,谷歌约四分之一的代码由AI生成;到去年秋天,这一数字已提升至50%。谷歌持续推动员工将AI应用于编程及其他日常工作。公司CEO桑达尔·皮查伊周三在博客中表示,谷歌正转向“真正以智能体为核心的工作流程”,让工程师能够承担更多自主任务。他举例说:“最近,一项由智能体和工程师协同完成的复杂代码迁移工作,其完成速度比一年前仅靠工程师时快了6倍。”目前,谷歌工程师主要使用自家Gemini模型来生成代码。部分工程师还被设定了明确的AI使用目标,这些目标将纳入今年的绩效评估。值得注意的是,近几个月来,谷歌DeepMind的部分员工已获准使用Anthropic旗下的Claude Code工具,这也在团队内部引发了一些紧张情绪。在其他科技巨头方面,微软CEO萨提亚·纳德拉表示,微软部分项目中已有20%至30%的代码由AI编写。微软CTO凯文·斯科特也在同月预测,未来五年内,95%的代码都将由AI生成。

47. 【通过测试≠没有bug:AI编程的致命盲区】快速阅读:Claude 4.6写代码会埋下严重bug,自己却审查不出来。必须用Codex 5.4反复审核每次提交。“通过测试”不代表没问题——AI太擅长写能通过的测试了。---Sterling Crispin分享了一个残酷发现:Claude Opus 4.6是优秀程序员,但会持续产生严重bug,无论让它自审多少次都发现不了。解决方案?用GPT 5.4的Codex CLI对每次提交审核4遍以上。有观点认为用传统工具——linting、类型检查、测试门槛——就够了。Sterling直接反驳:AI最爱干的就是写能通过测试的测试。这是个盲区。你可以让Claude在全新上下文中反复检查自己的代码,直到它说“没问题了”,然后Codex仍能揪出bug。“通过测试就没bug”是个疯狂假设。代码可能运行完美,测试全绿,但藏着一个细微的深层误解,毁掉整个系统的意义,导致灾难性故障。这种错误,传统validator抓不到,单元测试也无能为力,因为模型已经被过度优化成“写通过测试的代码”。为什么不直接让Codex写代码?Sterling说Codex像个教导主任,过度优化“正确代码”,却错失系统真正目的(telos)。太官僚了。Claude更适合日常驾驶,但需要Codex这个苛刻的审计员盯着。有开发者开始探索plan-with-codex模式:让Claude做计划,Codex审核,两者循环直到Codex批准——在写代码前就把错误拦住。另有人用多模型代码审查:Opus负责架构逻辑,Codex抓安全漏洞,Kimi K2.5查性能问题,Sonnet 4.6管代码风格。一个被反复引用的回复:你得让它完全重写代码,从根本上消除那类bug的可能性。否则就是无限循环,让agents猜这个bug是不是“真的”、“重要的”。x.com/sterlingcrispin/status/2035031512123678994#AI创造营##人工智能#

48. AI代码审计

49. AI代码审查工具集成趋势

50. 为什么你的AI代码审查工具总在“试错”?先补齐这2个核心能力

51. AI Agent自动审代码,2026年人类程序员的代码审查还有意义吗?

52. 旁听斯坦福的AI编程课(第十讲)

53. AI写代码之后谁来审查代码

54. 当AI审查“先入为主”

55. AI生成代码的三大常见病灶,及目前代码审计升级思路

56. 自验证 Agent 的幻觉

57. 产品经理如何在ai编程中做代码验证

58. Vibe Coding 实战 系列三

59. 如何把控 AI 生成代码的质量和安全?

60. 我在 CLAUDE.md 里加了 30 行安全约束,AI 生成代码的漏洞率降了一半

61. 91%的审查时间增长

62. AI生成代码的五大安全关卡

63. 大多数开发者不信任 AI 生成的代码,但即便如此,他们也往往不会去检查——Sonar 的一项开发者调查发现,AI 工具的采用造成了验证瓶颈

64. AI 智能体安全警报

65. LLM 写的代码为什么总是”看似合理”但不是”正确”?

66. LLM 输出到这步才算可靠

67. 把代码审查做成 Skill

68. 你的代码,已经开始被AI审判

69. AI 代码审查(AI Code Review)

70. AI 时代的代码审查

71. AI代码审查全面指南

72. 大模型时代

73. 用AI做代码审查

74. AI代码审查工具降本增效

75. AI写70%,剩下30%难得要命?Google工程师直言

76. 代码审查自动化

77. 用AI写代码再用AI做代码审查,世界已经疯成这样了?

78. AI代码审查调了两周,第三层让我重新理解了"审什么"

79. Linus 怒了! 给 AI 使用指定规则 | The PrimeTime

80. 代码审查将死 - 如何终结代码审查

81. AI编程智能体2026

82. AI 写了 46% 的代码,技术债却翻了 3 倍

83. 2026软件工程新范式

84. 企业使用 AI 代理进行代码开发的规范2026Q1 v1 (简略版) - 哔哩哔哩

85. AI安全风暴眼中的中国抉择

86. 代码审计代码桥:建立LLM与代码的MCP桥梁

87. 智信代码:降低AI生成代码风险

88. 旁听斯坦福的AI编程课(第十讲):AI 代码审查

89. 中小企业智能安全评估方案②:AI自动代码审计工具精选与实战指南

90. 关于AI辅助挖掘漏洞报告提交规范的公告

91. AI时代的安全悖论

92. 紧急警报:AI 编程工具发现 30+ 安全漏洞,独立开发者必读

93. 第四章:用AI做代码审查:比人工Review快10倍

94. 静态分析工具作为LLM生成代码安全性评估标准的可靠性审视

95. 基于大语言模型的代码审计与漏洞检测:技术栈、解决方案与研究方向综述

96. OpenClaw火到200k星,开源AI神器,竟成最大安全噩梦!

97. AI编程安全必备!这些开源工具帮你防漏

98. 【ICML’25 论文|让 AI 像专家一样审代码】如何精准捕捉那些足以让系统崩溃的“致命 Bug”?

99. 为什么你的AI代码审查工具难以“降本增效”?关键在于“流程重构”而非“工具替换”

100. 初探AI辅助代码审计

101. 代码审计新盲区:当AI Agent的“工具链”成为攻击高速公路

102. 让AI给你做代码审查的方法

103. 以一个实际的skill案例来说明代码审计skill的构建方法

104. 做了一个多AI相互review的agent项目

105. MonkeyScan实测:一款轻量、精准、高效的AI代码审计工具

106. AI代码审查革命:Code Review正在被AI颠覆

107. 多AI协作开发实战:从0到MVP的交叉验证工作流

108. DeepAudit:人人可用的 AI 审计工具|优秀开源 AI 代码审计项目 实战部署全攻略

109. Vibe风”编程:AI写代码,安全感谁来给?

110. 免费 AI 代码审计工具MonkeyScan,梭哈白嫖!

111. Claude AI 编程:代码调试 + 漏洞检测实用教程

112. AI在代码审查中的测试:自动识别潜在漏洞

113. 基于大模型代码审计的自动化安全分析:解决方案、技术栈与前沿方向

114. 论文分析:静态分析工具在评估LLM生成代码安全性中的可靠性问题与一种融合持续人类反馈的框架

115. 2026软件工程现状:AI已接管70%代码,初级岗锐减!程序员从“写代码”转向“审代码”,行业瓶颈彻底转移

116. AI生成代码有漏洞,程序员如何做工业级代码审查?

117. AI代码评审彻底失灵?干净代码藏致命bug,程序员必看避坑指南

118. AI代码审查工具选型指南:如何实现缺陷率降低30%以上的目标?

119. 实测三个AI代码审查工具后,这个让我删掉了老代码审查流程

120. AI 代码审查再进化:AutoDev 多智能体协作架构深度解析

121. 基于大模型的自动化代码审查工具:让 AI 成为你的 Code Review 助手

122. LLM代码审计对抗性评论的鲁棒性评估

123. GitHub推出更灵活的Copilot代码审查指引,让团队规范更好落地

124. AI代码质量守护者:MyBrokenCode开源审查工具全解析

125. 解放双手,让 AI 帮咱审查代码——GitLab 智能审查实战指南

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章