AI测试左移右移实战:从200条Eval开始构建质量闭环
06-02 16:43
精选参考来源
精选参考来源
1. 折叠屏适配:鸿蒙ArkUI有话要说
哔哩哔哩 2026-05-10 00:00:00
2. AI编程大战正式开打! Claude vs GPT同一天放大招,不是比谁代码写得好,而是AI开始自己组队当项目经理了。#大咖观察 #红衣聊AI #编程 #ChatGPT
抖音 2026-02-10 00:00:00
3. 拆解路子最野的AI出海生意,用开源AI快速跑通完整工作流
哔哩哔哩 2026-01-28 00:00:00
4. 最近一个月在Wegent项目里写了13万行代码(去掉package.lock之类的文件至少也有10万行左右),算上周末,这个月平均每天接近4000行,AI代码占比超过99%。 除了开发这个项目之外,我还负责另外三个方向的业务的管理工作,每天的工作还包括对接需求、推进项目、写汇报材料、管理团队、被拉去开各种莫名其妙的会和一个技术中层可能需要做的一切。 没有AI的情况下根本不可能做到完成管理工作的同时还能如此密集的进行开发。 来说说我的日常编码工作方式: 开会、带娃、走路或者任何突然有灵感的时候用把需求提到Wegent上,电脑或者手机都用,一般每天会提十几个想法,最终落地7到8个。 Wegent会在云端环境完成开发,任务完成后会自动提pr。 等我在电脑前的时候打开pr列表,在本地环境进行功能验收测试。 AI提了的pr已经做了单元测试、集成测试和e2e测试,一般不会出现严重的改飞了的情况。测试有大问题或者方向性错误就在Wegent的任务里接着修复,小问题用本地的claude code或者ai ide修复。 修复的时候切到下一个pr继续测试,本地一般会开三个worktree,每个空间开一个ai ide和一个cc,最多六个ai一起修改(再多的话任务上下文切换带来的精神压力太大了)。 功能验收没太大问题就会合并pr,后续调整会重新从wegent发起修改任务,而不是追求一次改到完美。(非常重要!) 大块的功能会先用Wegent的澄清模式捋一下需求,然后用澄清模式生成的提示词在Wegent里提个开发任务生成poc大概感受一下效果(不到1小时能搞定),然后废掉poc,重新用Wegent开发一个可用版。 如果是小改动,直接用Wegent的开发模式,不做澄清。感觉问题描述不清或者估摸着特别难改的,在本地用ide的AI边分钟边改。 再小的改动,也尽量从云端发起,而不是在本地开发。因为本地开发本质上还是串行的,开始改到改完需要连续的时间,而云端开发可以极致的利用碎片化时间,30秒钟提个想法就可以做别的了。 即使在agents.md里要求ai随时进行重构,还是会需要单独做一些重构任务,一般会在ide修改的过程中用ai完成。 并行开发的过程中出现代码冲突的话让ai自行解决,效率完爆人类。 高强度的AI开发给我的几个感觉: 像我这种什么都懂一点的人收益非常大(我兼职了这个项目的UI/交互/产品/前端/后端/运维和项目、团队管理),因为只要你在哪个方向上能做一点,AI就能在那个方向上帮你多做一点。 AI开发提效的质变点在于人什么时候“退出”开发流程,只做三件事:最开始决定做什么,最后面验收成品是不是我要的,和中间纠正哪里做错了。一旦人退出了开发流程,用同样的精力就可以管理很多个“AI开发流水线”,效率会是几何级的上升。 有了AI之后,“要做成什么样子”变成了人和人之间最重要的、决定性的区别,其次是“为什么做不成那个样子”。回答不了这两个问题的人,过不了多久就会被AI淘汰掉。
新浪微博 2025-12-15 00:00:00
5. AI都能自己操作3D打印机了!钉钉悟空 接入3D打印工作流测试
哔哩哔哩 2026-03-25 00:00:00
6. Anthropic官方报告:8大趋势说透AI编程未来,60%代码AI写的,老金实测项目带你看!
微信公众号 2026-03-03 00:00:00
7. 为什么银行科技研发需要“规格驱动开发(SDD)”?如何构建AI与人类的共同契约?
知乎 2026-05-11 00:00:00
8. AI,正引爆一场全球抢矿大战? #大有学问 #红衣聊AI #矿产 #能源 #资源
抖音 2026-05-12 00:00:00
9. Vibe Coding 终极指南 V1.2开发者在与 AI 搭档编程时,经常面临规划混乱、代码难维护的问题。Vibe Coding 是一个以规划为核心,结合系统提示词和模块化设计的终极 AI 编程工作流程,帮助你从想法到可维护代码,形成一条清晰可控的流水线。它提供了丰富的提示词库,涵盖需求澄清、开发计划、代码实现、测试验收等全流程,确保 AI 不会失控,项目结构清晰且易于扩展。无论是 CLI 还是 VSCode 扩展,都能顺畅体验。主要特点包括:- 以规划驱动开发,避免 AI 自主引发混乱;- 完善的系统级提示词集合,规范 AI 行为边界;- 闭环交付流程,从需求到测试全覆盖;- 共享记忆库,实现人机同步的项目上下文;- 支持多种 AI 模型和环境,灵活高效。项目地址:github.com/tukuaiai/vibe-coding-cn/tree/main适合开发者、团队和 AI 协同工作场景,助你打造可审计、可复盘、可持续的 AI 编程新体验。
新浪微博 2025-12-13 00:00:00
10. 【实战】AutoClaw(澳龙)全上手:一键部署 + 飞书接入 + AI 网络运维资讯日报落地
知乎 2026-03-22 00:00:00
11. 演讲回顾|华苏科技李鹏博:人机协同重构座舱测试范式,AI 破解行业三大瓶颈
微信公众号 2026-03-25 00:00:00
12. Cloudflare 用 AI 一周重写了 Next.js Cloudflare 发布了一个名为 vinext 的开源项目,用 AI 在一周内重新实现了 Next.js 框架的核心功能,总花费仅约 1100 美元的 API token。 vinext 基于前端生态中广泛使用的构建工具 Vite,而非 Next.js 自带的 Turbopack。它可以作为 Next.js 的直接替代品——开发者只需把项目中的 next 命令换成 vinext,原有代码基本不用改。早期测试显示,使用 Vite 8 的 Rust 打包器 Rolldown 时,构建速度比 Next.js 快 4.4 倍,客户端包体积缩小 57%。 这个项目的起因是 Next.js 长期存在的部署痛点。Next.js 的构建产物高度定制化,部署到 Cloudflare Workers、AWS Lambda 等平台时需要大量适配工作,之前的方案 OpenNext 本质上是在"逆向工程"Next.js 的输出,每次版本更新都可能出问题。 vinext 换了个思路:不去适配输出,而是在 Vite 上重新实现 Next.js 的 API 接口,从根本上解决了兼容性问题。 整个项目由一位工程经理指挥 Claude 完成,跑了 800 多次 AI 编码会话。项目目前覆盖了 Next.js 16 约 94% 的 API,有 1700 多个单元测试和 380 个端到端测试,已有政府网站在生产环境中使用。Cloudflare 还顺带做了一个"流量感知预渲染"功能,根据实际访问数据只预渲染高流量页面,避免了大型站点动辄几十分钟的构建时间。 这条新闻很多人把焦点放在“1周”用AI做出来上面,但是也要看看为什么能一周做出来。 这个项目能成功,靠的是几个条件同时到位。 首先,Next.js 文档极其完善,Stack Overflow 上积累了海量问答,这些内容早就进了大模型的训练数据,让 AI 实现一个 getServerSideProps,它不会瞎编,因为它确实被训练过。 其次,Next.js 自带几千个端到端测试,团队直接搬过来当验收标准,相当于有了一份可以机器验证的"规格说明书"。 再加上 Vite 本身已经解决了打包、热更新这些底层难题,AI 不用从零造轮子,只需要在 Vite 上面"教"它说 Next.js 的语言。 最后也是最关键的:模型能力到了。 CloudFlare 团队认为几个月前这事还做不了,因为早期模型无法在这么大的代码库里保持一致性,而现在的模型能把整个架构装进上下文窗口,甚至会自己去翻 Next.js 和 React 的内部实现来排查 bug。 这四个条件缺任何一个,效果都会大打折扣。 工作流程其实很简单直接。 工程经理先花几小时和 Claude 讨论架构方案,定好蓝图,然后按模块拆任务: 定义任务、让 AI 写代码和测试、跑测试、过了就合并、没过就把报错扔回给 AI 让它改。 PR 的代码审查也交给了 AI agent,形成了几乎全自动的反馈闭环。 但这不是按一下按钮就完事。AI 经常自信满满地写出看似正确但行为不对的代码,架构决策、优先级判断、识别 AI 走偏了,这些仍然要人来把控。 用博客的原话说:给 AI 好的方向、好的上下文、好的护栏,它就能高产;但方向盘必须在人手里。 博客:http://t.cn/AXcVfIR6 对照看我以前写的一篇《Coding Agent 的舒适区》:http://t.cn/AXcVJbO5
新浪微博 2026-02-25 00:00:00
13. 【231天缩短至13天:AI研发的质变不是变快,而是消除流程】Salesforce用Claude Code把231天的工程迁移缩到13天,最关键的数字其实不是速度,而是那个包含21个接口、100%测试覆盖率的单次PR。以前总觉得AI是个更快的“副驾驶”,但这属于典型的用旧思维理解新生产力。这次Salesforce真正跑通的逻辑是:直接取消中间环节。他们拿掉Token限制,把规则和标准封进Agent的自动化循环里,让AI自己构建、报错、验证,人类只负责定义规则和最终卡点。普通团队用AI,是在原有的流程里拼命催油门,结果卡在跨团队沟通和代码评审的红绿灯前。真正跑在前面的玩家,已经把红绿灯和马路一起废掉,直接重构了整个研发流程的“物理学定律”。当AI能低成本写完代码顺便把测试覆盖率拉满,效率和质量的既定置换关系就不复存在了。这不再是工具的升级,而是生产关系的推倒重来。www.salesforce.com/news/stories/how-engineering-became-agentic/
新浪微博 2026-05-31 00:00:00
14. 掌握AI Agent开发:开发者锁定未来五年价值的硬核竞争力
微信公众号 2025-12-13 00:00:00
15. 黄仁勋最怕中国AI的事 DeepSeek刚刚做到了 黄仁勋最害怕事还是发生了:DeepSeek V4发布,华为昇腾超节点深度适配,全球AI圈等待已久的大事落定,聊一聊背后的三大核心真相 #ai #deepseek v4 #deepseek #黄仁勋 #梁文锋
抖音 2026-04-27 00:00:00
16. //@宝玉xp:重构代码这事,最佳实践是先写自动化测试,先保证自动化测试覆盖,然后再去替换模块代码,确保替换后测试还能通过,这样重构后系统还是相对稳定的。AI 正适合写自动化测试,另外对于用 AI Agent 写代码,有了自动化测试,也更容易验证生成结果的好坏,能提升效率,至于工具,主流的 Coding Agent 工具都挺好//@我拖沙養妳:宝玉老师,我现在面临的问题是,前端历史项目由于技术栈老旧,现在增加或修改功能比较混乱,也没有文档。我想借助AI来重构项目并能够形成文档,请问老师有什么建议?使用什么AI工具呢?//@宝玉xp:原型在确认模糊不清的需求上是相当有优势的,尤其是AI生成的高保真可以交互的结果//@迷糊-Tree:最近其实遇到一个类似的问题,一个小feature写了两周多。主要问题就是需求模糊+细节繁琐。因此用codex也很难直接出结果。下次按这个流程应该能快很多
新浪微博 2026-01-05 00:00:00
17. Vibe Coding 是一个基于 AI 结对编程理念打造的终极开发工作站,旨在帮助开发者高效、系统地将创意转化为可维护代码。它融合了作者多年开发经验与丰富的提示词库,形成一套严谨且灵活的流程体系,强调规划驱动与模块化设计,避免 AI 失控造成项目混乱。核心理念在于“规划就是一切”,通过定义生成器(α-提示词)与优化器(Ω-提示词)两大母体提示词,构建递归自我优化的 AI 系统,使提示词及技能持续进化,最终实现无限逼近预期目标的自我超越。Vibe Coding 提供完整的开发流程指南:从网络环境配置、开发环境搭建、IDE 设置,到项目设计文档撰写、技术栈推荐、实施计划生成,再到代码实现、测试与迭代,每一步均配合 AI 进行,确保开发高效且可控。特别强调先结构后代码,避免技术债务积累。工具链方面,推荐使用 Visual Studio Code、Neovim 等强大编辑器,配合 Claude Opus 4.5、gpt-5.1-codex 等顶级 AI 模型,实现代码生成、测试、调试、文档管理等一体化工作流。还集成了丰富的辅助工具如 Augment (上下文引擎)、Zread (代码阅读)、tmux(终端复用)、DBeaver(数据库管理)等,极大提升开发体验。项目配套了详尽的提示词库,涵盖系统提示词、编程提示词、用户提示词及辅助提示词,支持快速构建高质量的 AI 交互策略。通过严格的规则和上下文管理,确保 AI 生成代码的质量与一致性。此外,Vibe Coding 还提供丰富的实用技巧和常见问题解答,帮助开发者快速上手并解决开发中遇到的各种挑战。其开源 MIT 许可让社区能自由贡献与扩展。Vibe Coding 通过“规划驱动 + 上下文固定 + AI 结对执行”,让「从想法到可维护代码」成为一条清晰且可审计的流水线,极大提升了开发效率与代码质量。项目开源地址:github.com/tukuaiai/vibe-coding-cn无论是新手入门还是资深开发者,Vibe Coding 都能帮助你驾驭 AI 助力的开发新时代。
新浪微博 2025-12-17 00:00:00
18. 本周AI项目推荐:Violoop、Zettlab、EVA OS……
微信公众号 2026-04-19 00:00:00
19. 游戏开发AI-Native之路(一):原型驱动开发 PDD
知乎 2026-04-19 00:00:00
20. 大模型时代,软件测试如何进化?这本书给出了答案
微信公众号 2026-05-30 00:00:00
21. //@james逝水流年:差不多,我就是这么用AI模型的 用起来是 7 个斜杠命令:/spec 开始写需求、/plan 拆解任务、/build 编码、/test 跑测试、/review 代码评审、/code-simplify 重构简化、/ship 部署上线。输入命令,背后自动把相关技能组合调起来。
新浪微博 2026-04-27 00:00:00
22. LLM可用性不到99%,为何AI应用以及Agent应用都要默认接受这种SLA?
知乎 2026-01-07 00:00:00
23. 我的 AI 驱动开发工作流:基于 Cursor 的全流程实战开发 SOP
知乎 2026-06-01 00:00:00
24. 2025过去了!这一年你是不是也在为AI焦虑? 老周用360一整年的实践,告诉你答案:不用怕,抓住Agent就赢了! 从我自己敲代码做100多个智能体,到带领团队All in,这条AI布道之路,全是实战干货。 2026,你想和智能体一起搞定啥?评论区留言,老周帮你研究!#大咖观察#2026 #年度总结 #红衣聊AI #agent
抖音 2025-12-31 00:00:00
25. 华为AI开发三大颠覆性突破:代码生成、自动测试、Bug修复全搞定!码农福音还是大锤? 华为云码道(CodeArts) 代码智能体公测版今日发布,集代码大模型、IDE、自主开发模式为一体,覆盖代码生成、研发知识问答、单元测试用例生成、专家技能Skills、Codebase代码库索引、规范驱动开发等AI Coding技术,同时接入开源模型GLM-5.0、DeepSeek-V3.2以及华为自研模型,并提供鸿蒙的专属模型。 鸿蒙专属模型,纯血鸿蒙应用开发简单,后续鸿蒙APP将爆发,各种鸿蒙APP会填补缺口。对一些公司来说是个机会窗。
新浪微博 2026-02-27 00:00:00
26. 用 Claude Code 写代码,有两个用法值得了解一下。1. 不要让 AI 反应式修 bugAI 默认行为是:你说哪里有问题,它修哪里。复杂项目里,这很危险。你看到的 bug 几乎不是真正的问题,只是表象。AI 如果只处理表象,每次给你打个补丁——补丁会越堆越多,系统越来越脆。正确做法:告诉 Claude「不要只修这个 bug,帮我分析这个问题的根因是什么」。1)让它先分析,再动手2)给它足够的上下文,而不只是报错信息3)本质上是:把 AI 从「反应式工具」升级成「诊断工具」2. 测试阶段前置传统流程是:写代码 → 手动测试 → 发现 bug → 修。AI 可以完全打乱这个顺序。在你碰 UI 之前,让 AI 帮你模拟输入、边缘情况、失败场景,把「破坏」这件事提前做。手动测试就变成了验证,而不是探索。1)测试成本降低,迭代周期缩短2)bug 在越早发现,修复代价越小3)本质上是:把「发现问题」这件事从手动测试阶段,挪到了代码阶段#HOW I AI# #程序员#
新浪微博 2026-04-25 00:00:00
27. 如何用AI打造自己的NAS项目,小白向教程,AI编程助手MonkeyCode
微信公众号 2026-02-05 00:00:00
28. 多模态数据存储、治理、开发管理平台实现 AI-Ready 的落地实践
知乎 2026-01-26 00:00:00
29. B 站下一代多模态数据工程架构的落地实践
知乎 2026-03-09 00:00:00
30. 教育部《教师生成式人工智能应用指引(第一版)》实践视角解读:AI时代教师能力的三个关键转型
微信公众号 2025-12-17 00:00:00
31. 从780行代码到13600行的飞跃,这不仅是数量的扩张,更是开发范式的演变。David Bau近期分享了他通过Claude进行Vibe Coding的深度实践,揭示了在人工智能驱动开发的时代,人类开发者应当如何重新定位。当代码生成的成本趋近于零,代码库的膨胀速度将远超人类的阅读速度。David Bau指出,这种增长如果缺乏控制,本质上是一种技术负债。为了在AI狂飙突进的生成能力面前保持掌控,开发者必须遵循两条核心准则。第一,始终掌握架构的所有权。AI可以填充细节,但人类必须定义结构。如果开发者失去了对整体架构的直觉,代码库就会变成一个不可知的黑盒。第二,建立元认知基础设施,即测试你的测试。在Vibe Coding的流程中,验证比编写更重要。如果不能确保测试本身的有效性,那么AI生成的成千上万行代码不过是建立在沙滩上的城堡。在这种模式下,开发者的注意力分配发生了根本性转移。我们需要寻找那1%最值得关注的代码。这些关键点通常隐藏在测试覆盖率最低的地方:它们要么是AI无法理解的逻辑边缘,代表了AI能力的极限;要么是废弃思路留下的残骸,需要人类进行断舍离。一个深刻的洞察是:当代码变得廉价,判断力就变得昂贵。未来的编程将不再是关于语法的苦修,而是关于意图的表达与边界的界定。开发者正在从码农转型为架构师与审计员,编写代码的行为正在被编写测试用例和构思创意所取代。代码量的增加并不等同于价值的提升,除非你投入了等量的思考去约束它。在AI时代,少即是多,受控的增长才是真正的进化。x.com/davidbau/status/2001744610859897095
新浪微博 2025-12-20 00:00:00
32. 用AI辅助重构老旧前端项目(如jQuery转React),有哪些最佳实践或坑?
知乎 2026-04-12 00:00:00
33. 西空智造突破熔池监控“闭环”瓶颈:从“看得见”到“控得住”
微信公众号 2026-02-13 00:00:00
34. OpenTelemetry + 云监控 2.0:打造你的云原生全栈可观测
知乎 2026-02-26 00:00:00
35. 怎么验证AI生成的单元测试是真的在测东西,而不是形式上通过?
知乎 2025-12-24 00:00:00
36. AI真能“慧眼识珠”?使用LLM自动化论文评审的陷阱与潜力
微信公众号 2026-01-02 00:00:00
37. 英伟达投资公司首次在太空中训练 AI 模型,确有需要还是赚噱头?
知乎 2025-12-14 00:00:00
38. AI风口下,程序员的破局指南!大模型应用开发岗年薪百万成常态(附关键策略+大厂内部资源)
知乎 2026-01-27 00:00:00
39. 先建“语义基座”,再谈运维智能!阿里云以 Operation Intelligence 定义 AIOps 新范式
知乎 2026-02-11 00:00:00
40. 《扣子开发 AI Agent 智能体应用》003-扣子 AI 应用开发平台介绍(选择扣子的理由)
微信公众号 2025-12-22 00:00:00
41. themodernsoftware.dev/斯坦福大学的公开课CS146S: The Modern Software Developer 这是一门教导学生如何利用最前沿的 AI 工具来将生产力提升 10 倍的课程。不仅教授理论,更强调掌握实际的 AI 辅助开发、自动化测试、智能文档编写和安全漏洞检测等技能。课程涵盖了从基础的 Prompt 工程到复杂的 AI Agent 开发的全流程: 第 1 周:LLM 编程入门 - 学习如何高效编写提示词(Prompt Engineering),理解 LLM 原理。 第 2 周:代码智能体 (Coding Agents) 解构 - 学习 Agent 架构、工具调用以及 MCP (Model Context Protocol)。 第 3-4 周:AI 集成开发环境 (AI IDE) 与模式 - 学习上下文管理、与 Claude Code 等工具的协作模式。 第 5 周:现代终端 (Modern Terminal) - 如使用 Warp 等工具进行终端自动化。 第 6-7 周:测试、安全与维护 - 利用 AI 进行代码审查 (Code Review)、漏洞检测 (SAST/DAST) 以及自动化测试。 第 8 周:自动化 UI 构建 - 使用 AI 快速构建前端和原型。 第 9-10 周:部署后运维与未来展望 - 涉及 AI 在 SRE中的应用以及软件开发的未来趋势。#科技先锋官#
新浪微博 2026-01-01 00:00:00
42. CS146S: The Modern Software Developer斯坦福大学现代软件开发课程(2025),旨在教授学生如何利用大语言模型等AI工具革新软件开发流程,从而将生产力提高十倍。课程内容涵盖AI辅助开发、自动化测试、智能文档和安全漏洞检测,旨在培养学生掌握现代软件工程理论和前沿AI工具的实践能力。课程主页:themodernsoftware.devGitHub:github.com/mihail911/modern-software-dev-assignments#AI创造营##人工智能#
新浪微博 2026-03-02 00:00:00
43. React AI 开发模式
知乎 2026-04-06 00:00:00
44. AI 术语通俗词典:交叉验证
微信公众号 2026-05-01 00:00:00
45. 亚马逊将禁止初级工程师直接提交 AI 代码,如何评价这一举措?AI 提效与工程质量如何平衡?
知乎 2026-03-15 00:00:00
46. 2026年最大风口:AI应用层!年薪百万的AI应用开发岗暴增!附关键策略+大厂内部资源
知乎 2025-12-26 00:00:00
47. 2025 年 AI 大战,谁赢了?#AI中场时刻#知乎答主【toyama nao】在过去一年里测试了 126 个 AI 模型,对 49 个模型进行了编程测试,对 21 个模型进行了视觉测试,花在模型测试和撰写评估报告上的时间超过了 400 个小时。关于「大模型的未来会走向何方」,来看看他怎么说~👇
新浪微博 2025-12-26 00:00:00
48. 下一个风口:AI应用开发!附4个月保姆级学习路线+大厂内部资源!
知乎 2026-02-03 00:00:00
49. 《扣子开发 AI Agent 智能体应用》006-扣子 AI 应用开发平台介绍(扣子快速开发人门)
微信公众号 2025-12-24 00:00:00
50. 现在的程序员想拿高薪,得拼AI技术?(附转型关键策略+保姆级实战资源)
知乎 2025-12-08 00:00:00
51. 如何转行高薪 AI 测试?照这个路径抄作业就行了!!
知乎 2025-12-15 00:00:00
52. 以智能化评测赋能数据分析:DeepInsight自动化评测集生成与实践
知乎 2026-01-29 00:00:00
53. 《扣子开发 AI Agent 智能体应用》008-扣子插件和卡片(开发自定义插件案例:查询股票价格)
微信公众号 2025-12-27 00:00:00
54. 当AI能写测试脚本时,测试工程师需要具备这些能力(附升职涨薪关键策略+保姆级资源)
知乎 2025-12-08 00:00:00
55. AI智能体开发太散乱?这本书从理论到实战,给你一条“直通”路径
微信公众号 2025-12-24 00:00:00
56. 自动化LQA:AI赋能翻译与本地化质量保障
微信公众号 2026-03-08 00:00:00
57. 拒绝“Demo 级”架构:基于 SAE × SLS 构建 Dify 高可用生产底座
知乎 2026-02-10 00:00:00
58. AI编程代理经常缺乏生产级工程技能,容易跳过规格编写、测试验证、代码审查等关键步骤,导致代码质量低下、后期维护成本高。agent-skills 为AI编码代理提供生产级工程技能包,覆盖从需求定义到部署上线全开发生命周期的最佳实践。包含19个结构化技能工作流和7个斜杠命令,支持Claude、Cursor、Gemini CLI等多平台AI工具,让代理像资深工程师一样规范开发。GitHub:github.com/addyosmani/agent-skills主要功能:- 7个开发生命周期命令:`/spec`(规格先行)、`/plan`(任务分解)、`/build`(增量实现)、`/test`(测试验证)、`/review`(代码审查)、`/code-simplify`(代码简化)、`/ship`(安全部署);- 19个核心技能:从`idea-refine`(想法提炼)到`shipping-and-launch`(上线发布),每个技能包含步骤、工作流验证和反合理化表;- 专业代理角色:`code-reviewer`(资深工程师视角)、`test-engineer`(测试专家)、`security-auditor`(安全审计);- 参考清单:测试模式、安全检查、性能优化、无障碍标准等快速参考;- Google工程实践:集成Hyrum's Law、测试金字塔、Chesterton's Fence、Trunk-based Development等实战经验;- 多平台集成:Claude Code一键安装,Cursor规则文件,Gemini原生技能,支持任何Markdown提示的AI代理。通过`git clone`本地运行或Marketplace安装,适合开发团队、AI代理爱好者和工程实践训练。#AI编程# #工程技能# #AgentSkills#
新浪微博 2026-04-06 00:00:00
59. 2025 AI 原生编程挑战赛收官,5500+ 战队攻关 AIOps 工程化闭环
知乎 2026-02-04 00:00:00
60. 《扣子开发 AI Agent 智能体应用》005-扣子 AI 应用开发平台介绍(扣子的目标群体和架构)
微信公众号 2025-12-24 00:00:00
61. 小米推出三款自研大模型,既然算法会迭代,算力能租借,数据的独占性是否才是 AI 公司唯一的真护城河?
知乎 2026-03-27 00:00:00
62. ML:数据集、训练集与测试集
微信公众号 2026-04-21 00:00:00
63. 13 讲实战课全上线!让 Java 开发者快速入局 AI 应用开发
知乎 2026-03-03 00:00:00
64. 展商推荐|华苏科技携 AI 测试黑科技亮相,还将在 AI 赋能研讨会重磅发声!
微信公众号 2026-03-02 00:00:00
65. 《扣子开发 AI Agent 智能体应用》002-扣子 AI 应用开发平台介绍(扣子的背景与核心特征)
微信公众号 2025-12-22 00:00:00
66. #京东将建成全球最大具身数据采集中心#大数据技术标准推进委员会——高质量数据集实践指南1.0 理概念:数据集的概念、数据集的分类、高质量的内涵深入阐述高质量数据集的概念内涵 建体系:基于理论研究与产业实践,总结高质量数据集建设模式,提供一套覆盖数据集研发、交付、运维、运营全生命周期的建设方法论,并搭建建设运营的成效评估体系 促应用:梳理分析高质量数据集的应用情况,并辅助具体场景实践案例为方法论落地实施提供参考 看趋势:从建设运营能力成熟度、行业场景应用、协同生态建设等方面展望高质量数据集的未来发展趋势
新浪微博 2026-03-16 00:00:00
67. 人工智能通识课:机器学习之无监督学习
微信公众号 2026-05-13 00:00:00
68. 测试左移
微信公众号 2026-03-04 00:00:00
69. 测试左移和右移,到底该往哪边移?
知乎 2026-05-09 00:00:00
70. 测试左移
微信公众号 2026-03-16 00:00:00
71. 测试左移到底移了个啥?
微信公众号 2026-04-13 00:00:00
72. 2026测试左移
微信公众号 2026-05-12 00:00:00
73. 测试左移
微信公众号 2026-03-06 00:00:00
74. 测试左移常见误区,90%专家都踩过坑
微信公众号 2026-05-08 00:00:00
75. 测试左移实战
微信公众号 2026-03-17 00:00:00
76. 青岛国之信检测分享
微信公众号 2025-12-26 00:00:00
77. 测试左移是什么?聊聊这个超火的概念
微信公众号 2025-12-30 00:00:00
78. 测试左移 vs 传统测试
微信公众号 2026-04-21 00:00:00
79. 质量工程中被遗忘的“右移”
微信公众号 2026-04-13 00:00:00
80. 上线就炸?别让测试止步于发布!年底稳交付,右移才是关键
知乎 2026-01-29 00:00:00
81. Ai将会深层变革测试行业
小红书 2026-03-01 00:00:00
82. AI测试工程师
微信公众号 2026-03-21 00:00:00
83. AI时代直接拿代码说话
哔哩哔哩 2026-05-21 00:00:00
84. 霍格沃兹测试开发学社人工智能测试开发训练营2期
知乎 2026-04-09 00:00:00
85. 测试开发的 AI 原生转型
微信公众号 2026-05-26 00:00:00
86. 把安全前移到代码诞生的那一刻,AI驱动的软件安全左移实践全景
微信公众号 2026-04-12 00:00:00
87. 开发效率突破
今日头条 2026-01-27 00:00:00
88. 测试预测分析 vs 传统测试
微信公众号 2026-04-05 00:00:00
89. 当AI遇见自动化测试
今日头条 2025-12-14 00:00:00
90. 告别脚本依赖
微信公众号 2026-04-24 00:00:00
91. AI测试工具实战
微信公众号 2026-04-15 00:00:00
92. AI测试时代
微信公众号 2026-04-20 00:00:00
93. 应对AI Coding提效,测试体系的变革与重生
小红书 2026-05-01 00:00:00
94. 用1000个AI取代真人做产品测试|硅谷观察局
哔哩哔哩 2026-03-09 00:00:00
95. AI 狂飙
今日头条 2026-05-02 00:00:00
96. Anthropic揭秘“AI迭代Claude模型”的评估闭环
微信公众号 2026-05-25 00:00:00
97. AI辅助软件测试
哔哩哔哩 2026-03-23 00:00:00
98. DevOps?MLOps?LLMOps?2026 AI 部署必修课
今日头条 2025-12-24 00:00:00
99. OpenClaw赋能智能化运维-AI DevOps - 哔哩哔哩
哔哩哔哩 2026-03-19 00:00:00
100. AI助力DevOps智能化
微信公众号 2026-04-25 00:00:00
101. DevOps 已死?2026 年技术人必看的 3 个转型方向
知乎 2026-04-09 00:00:00
102. AI代码生成推动DevSecOps迈向机器速度
今日头条 2026-02-26 00:00:00
103. 质量文化缺失?如何从测试开始推动
知乎 2025-12-23 00:00:00
104. AI驱动DevOps-即AIDevops模式发展与价值
哔哩哔哩 2025-12-28 00:00:00
105. AI DevOps
哔哩哔哩 2026-03-21 00:00:00
106. 大模型下测试方案改进探讨
微信公众号 2026-04-26 00:00:00
107. LLM Eval
知乎 2026-05-23 00:00:00
108. LLM 应用调试
微信公众号 2026-03-06 00:00:00
109. 构建敏捷质效引擎
知乎 2025-12-21 00:00:00
110. 需求质量太差,测试人背锅,这个AI需求评审Skill重塑测试工程师的评审话语权
微信公众号 2026-05-11 00:00:00
111. [实战篇]第9章 从0开始构建AI测试体系
知乎 2026-03-28 00:00:00
112. NIST AI 800-4解读——部署之后
微信公众号 2026-05-09 00:00:00
113. AI安全测试落地实践指南
微信公众号 2026-03-06 00:00:00
114. AI 软件的上线流程
微信公众号 2026-02-05 00:00:00
115. 我用 AI 做记账 App
微信公众号 2026-05-27 00:00:00
116. 【论文速记】面向 AI Agent 的黑盒可靠性认证
知乎 2026-02-27 00:00:00
117. 数据价值左移论
哔哩哔哩 2026-02-08 00:00:00
118. 从0到1搭建AI辅助测试体系
微信公众号 2026-01-23 00:00:00
119. AI测试时代,如何破解资源“掉链子”难题?
知乎 2025-12-29 00:00:00
120. AI 应用软件的上线
微信公众号 2026-03-08 00:00:00
121. 【腾讯TMQ】和开发一起写代码,让测试左移起来
https://cloud.tencent.com/developer/article/1004575
122. 团队转型:AI安全测试实战指南
微信公众号 2026-03-23 00:00:00
123. 聊聊测试左移右移及适应场景
微信公众号 2025-12-26 00:00:00
124. 测试用例的验证点:如何确认AI生成结果的可靠性
今日头条 2026-02-04 00:00:00
125. 邮储银行“人工智能+”金融应用测试技术研究与实践
微信公众号 2025-12-09 00:00:00
126. 软件测试从业者必掌握的核心技能:AI驱动、左移实战与智能工具链
今日头条 2025-12-31 00:00:00
127. 测试左移实践指南:如何在需求阶段嵌入质量保障?
知乎 2025-12-13 00:00:00
128. 传统QA测不动LLM:你的AI应用正在默默“撒谎”
微信公众号 2026-04-20 00:00:00
129. Bug总在上线前才爆发?聊聊测试左移的5个落地方法
微信公众号 2026-03-16 00:00:00
130. 实测|2026年UI自动化工具格局巨变:Playwright超越Selenium,测试左移如何落地?
微信公众号 2026-05-12 00:00:00
131. 别再拍脑袋决策了!手把手教你用DeepSeek“扮演”用户,3步测出爆款方案
微信公众号 2026-05-06 00:00:00
132. 接手 AI 项目?LLM 测试这样做就对了
微信公众号 2026-04-12 00:00:00
133. AI 助力 DevOps 智能化:提升企业研发效能的革命性变革
知乎 2026-03-31 00:00:00
134. AGI 元年真的来了?站在 AI 工程一线,测试开发正在被提前推上战场
微信公众号 2026-01-16 00:00:00
135. 陈磊 AI重塑测试开发系统实践 - 哔哩哔哩
哔哩哔哩 2026-03-03 00:00:00
136. 数字浪潮下的银行突围:测试左移与CI/CD的破局实践
今日头条 2026-03-23 00:00:00
137. 同济胡笳团队LLM赋能自动驾驶场景测试全面综述!
知乎 2025-12-20 00:00:00
138. 深度解读:LLM测试开源方案实战指南
微信公众号 2026-04-26 00:00:00
139. 第一性原理看 AI 测试 Agent
小红书 2026-03-11 00:00:00
140. 当 AI 开始写代码:测试开发在系统里到底该站哪一层
微信公众号 2026-01-01 00:00:00
141. 一眼看懂:大模型从训练到上线的全链路测试点
微信公众号 2026-02-17 00:00:00
142. 【人工智能】AI测试开发能力图谱:测试岗位正在被重新定义-霍格沃兹测试开发学社
哔哩哔哩 2026-03-27 00:00:00
143. 左移测试的陷阱与真相:一位 QA 的实战反思
微信公众号 2026-01-14 00:00:00
144. 大模型测试常见误区,90%测试专家都踩过
微信公众号 2026-04-19 00:00:00
145. 惊!用二进制模糊测试思路搞垮LLM?Rust写的LLMFuzz太顶了
今日头条 2026-04-08 00:00:00
146. AI 自动化测试:测试策略,也能交给 AI 吗?
微信公众号 2026-01-14 00:00:00
147. 面试题:如何跟进AI产品的模型训练和优化?
今日头条 2026-03-17 00:00:00
148. 测试江湖31:测试策略的迭代逻辑 —— 在偏差与多元中找准方向
知乎 2026-03-10 00:00:00
149. LLM提示注入漏洞安全测试课程 - 哔哩哔哩
哔哩哔哩 2026-04-11 00:00:00
150. 基于AI大模型开发接口自动化测试的AI智能体AI测试开发实战
哔哩哔哩 2026-03-30 00:00:00
151. Langfuse:LLM 应用开发必备的开源可观测平台
微信公众号 2026-05-11 00:00:00
152. [Alan の测试] 测试策略能不能交给 AI?真相是:别让它拍板,但一定要用它算账
微信公众号 2026-01-25 00:00:00
153. [基础篇]第3章 AI测试的核心理念
知乎 2026-03-22 00:00:00
154. AI测试系统实现第2篇:用规则引擎,共30篇
小红书 2026-05-04 00:00:00
-
罗永浩怒斥电视机厂商:不毁灭没天理!171 547 -
评论有奖|这几件夏季洗护小事全网愣是争了好几年,今天一次性说清楚151 380 -
等等党赢麻了!11.5万起秦MAX来了,刚试完,有些话不吐不快103 276
已收藏
去我的收藏夹