今天AI内容圈有个新鲜热乎的案例,正好适合所有被"装个Skill就能批量出爆款"种草过的人,一起聊聊。
一个Skill让模型"超过Fable 5",今天被锤了
今天下午,一个叫J-Space的项目在AI圈炸了。宣传很诱人:只要装上它这份Skill,DeepSeek V4 Pro就能在多个基准上大幅提升,部分成绩甚至超过Fable5,速度和Token效率也能提高两倍以上。36氪

成绩对比表是作者自己发的,看着确实漂亮。但打脸来得很快:一位叫Jyleaves的用户自己拉了8张H20复测,89道题过了69道,得分77.5%,而J-Space报告里对应的成绩是87.1%。失败任务至少重跑了3次,依然复现不出报告里的提升,作者到现在也没公开完整评测记录。更离谱的是删帖——面对网友质疑,作者不仅没有公开完整的评测记录或者运行日志,还被曝删除质疑issue。36氪有人在Issue #23里说,自己发的质疑帖直接被删,只能重新发帖备份留证据。

这事给所有做内容的人提了个醒:以后看到"装上某某Skill,模型表现暴涨"的截图,先问三个问题——谁测的、怎么测的、有没有第三方复现。没有复现的数字,就当单方宣传看。
“装个Skill立刻起飞”,自媒体圈最吃这套
为什么专门讲给我们做内容的人听?因为这套话术现在主打的就是自媒体圈。哔哩哔哩上,一条"我把7年新媒体经验,做成了一个开源Skill。"的视频,评论区几乎全在刷"skill"求资源。哔哩哔哩小红书上"Claude千万别裸装,这几个skills必须装上!"这样的帖子,点赞收藏都是几千上万。小红书大家都在焦虑:别人都装了,我不装是不是就落后了。这份焦虑本身,已经成了别人的攻击面。
这个生态的真实样子:三组数据
第一,规模已经大到没人看得过来。8月11日发布的GitSkills数据集统计过,2026年7月GitHub上282,200个公开仓库里有3,797,117个SKILL.md文件,按内容哈希去重之后还剩大约188万份。知乎188万份是什么概念?你一天看100份,要看50年。靠口碑逐个筛,这条路已经走不通了。
第二,已经有人把它做成了组织化投毒的生意。6月,微软官方库遭投毒,105秒下架73个仓库。36氪

Black Hat上披露的skills.sh投毒事件手法更典型:攻击者先上架完全干净的初始版本养信誉,安装量起来之后再推更新投毒。有网上流传的分析帖复盘(单一来源,当参考):截至2026年8月2日,这批恶意技能累计安装量突破170万次,覆盖全球数万开发者终端。知乎先养号、后投毒,比直接挂毒隐蔽得多。
第三,漏洞比例不低。NVIDIA开源扫描工具时引用过一项大规模分析:42,447个Skill里,26.1%的Skill至少有一个漏洞,5.2%有明显的恶意意图。知乎注意,这是抽样里约四分之一有问题,是让你装前做检查的理由,不是让你全卸载的理由。
做自媒体的为什么更容易中招
三个原因。一是筹码真实:你的Agent连着账号凭证、API额度、稿件目录,被偷一次,损失的不只是钱。微博上有人给用OpenClaw的朋友提过醒:很多恶意插件就爱伪装成你刚需的样子,加密钱包追踪、看盘助手、视频总结、文案提取、效率增强、文档处理,看着特别香,一装直接踩坑。微博二是有信息差:我们擅长找工具,但多数人看不懂代码,分不清一条curl下载脚本意味着什么。三是有氛围推手:整个圈子都在喊"装了提效",停下来验证的人反而显得不合群——可被骗的,往往正是没停下来的那批。
装之前,先过这4道关
第一关:查来源。不知名作者直接跳过,优先找有背书的:NVIDIA今年5月推出了Verified Agent Skills计划,目前是一个包含162个经过认证Agent Skill的公开目录。知乎数量还不多,但起码是过了完整验证流程的。
第二关:查内容。打开SKILL.md,搜curl、bash、wget、eval这几个词,凡是要联网下载脚本再执行的,都值得警惕。小红书那位"装了12个Skills,3个在偷我密码"的博主还总结过一份自查清单:用npx skills list看自己装了哪些,不认识的作者直接删。
第三关:看复测。宣称"效果提升"的Skill,先找第三方复测再装。J-Space就是现成教材:官方宣称是一套数字,复测是另一套数字,删帖又是第三套操作。找不到复测的,效果预期直接按最低算。
第四关:少而精。有人实测,Agent装了80个Skill,你却不知道哪些在烧Token。知乎装得越多,暴露面越大,token消耗也越乱。连Claude Code之父都每半年清空一次claude.md、skills和hooks,让模型自己想办法。36氪顺便说个反差:现在最火的skill之一/grill-me,核心就一句话。知乎好Skill不靠堆篇幅,靠的是把一件事说准。
扫描工具:别裸装
实在手痒想装,先扫一遍再装。NVIDIA开源的SkillSpector走静态分析,内置64种漏洞检测模式,覆盖16个风险类别,给0-100的风险分,不需要API Key。知乎腾讯朱雀实验室扫了5万多个Skill后也提醒:Skill生态的风险不只是传统恶意代码,还包括提示注入、权限滥用、远程控制和排名投毒等问题,这四类就是自查时要重点盯的方向。知乎已经装了一堆的,可以用Cisco Skill Scanner整体扫一遍。
平台也下场了,这正在变成一门生意
早在6月,腾讯、阿里、字节就在混战Skill商店。36氪5月底小红书的RedSkill也内测了,博主可以在笔记下挂skill,官方的说法是会审核上架的技能包,筛掉病毒和恶意代码。知乎7月Anthropic官方上线了录屏加语音一键蒸馏Skill的能力,把自己工作流变成Skill的门槛降到了最低。36氪

这对我们既是机会也是提醒:平台开始管审核,野生投毒靠排名起量的空间会变小;但能冲上商店前列的,也可能是精心养出来的。别迷信"商店排名高=安全",前面那4道关,一道都不能省。
接下来值得盯的三个信号
一是J-Space作者会不会补发完整评测记录,补了就重新评估,不补就当反面教材立着。二是各家Skill商店的审核能不能管住"先干净上架、后更新投毒"这种延迟手法,这是目前最绕不开的一招。三是Verified这类认证目录的数量能不能涨起来,涨到一定规模,选Skill就会像选App一样省心很多。
最后说一句:Skill不是插件,是授权书。装之前,问清楚谁写的、碰什么、有没有人复测过。AI时代给自媒体人的效率焦虑是真的,但焦虑挖出来的坑,也是真的。