我们把硅星人变成了Agent!各位Founder请让你们的Agent放马过来吧!
周一笑|smiletalker王兆洋|Geisterspiele一切都在Agent化,那么「硅星人」本身能不能也Agent化呢?
这是我们最近一直在思考和尝试去改造的方向。
而其中,我们的第一个初见成效的尝试,也是今天想给大家隆重介绍的,就是:Demo Agent。
在我们的日常工作中,和各路创业者们的沟通和交流是越来越重要的部分。在这个过程里,我们发现,双方都有巨大的“痛点”,而这些都最适合由Agent来解决:
对于创业者来说,他们总是需要把同一个项目讲很多遍。给投资人讲,给媒体讲,参加活动再填一次。每个对象想知道的东西有些差别,但大量基础信息其实没怎么变。
现在,这类重复表达越来越适合交给 Agent。它可以读项目文件、整理已有材料,再根据不同对象重新组织一遍。
在我们和很多创业者朋友接触中,他们已经在这样做了。
而对于我们来说,每天都有很多创业者想和我们聊聊他们在做的产品和项目,但碳基生物的带宽实在有限,很多时候我们无法及时和所有创业者交流,这让我们总是担心错过很好的创业者。
于是我们想到,既然走在前面的创业者已经在把自己Agent化,那么这些由他们Agent负责传递的信息,在接收方也应该是Agent。
所以,我们决定把我们自己也先做成一个 Agent。也就是硅星人 Demo Agent。

简单来说,它的作用是:
如果你正在做一个项目,可以直接自己来聊,也可以把你的各种 Agent 派过来。它们会对接项目、回答追问、交材料,最后在我们这里留下一份整理好的档案。
给 Agent 的叫“硅基入口”。当然目前我们也留了一个让人直接聊的“碳基入口”。

现在,它已经开始干活,使用方法很简单。只要把下面这句话交给你的 Agent。
读取并执行这个 skill,帮我自荐项目https://Demo-Agent-5u1.pages.dev/SKILL.md1
做一个Agent版的硅星人,还挺不容易
在制作这个Demo Agent的过程里,我们踩了很多坑。发现把自己 Agent 化的确不是一件想当然的事情。
最初,我们想让 Agent 直接做初审,后来我们把这一步从前台流程里撤了下来。Agent 先负责聊、追问和整理,最后的判断留给真人。
我们当时给 Demo Agent 写了一份叫 人格.md 的行为规则,规定它该怎么聊、什么时候追问、哪些判断不能替人做。想的很好,但等东西跑起来,出现了新的问题。
最初我们给它列了十几个需要了解的维度:团队、产品、数据、进展、需求,希望它一个个问。效果很快就出来了,但问题就在于,它非常像表单。
用户回答一个问题,它说“明白了”,然后继续下一个,它等于一直在跟对方的Agent收集字段。这体验显然不够好。于是我们就给 人格.md 里加了一条“反馈先行”。这样,它每轮不能只问,还得先对刚刚听到的东西做一点回应。一笔账、一个矛盾、一个需要进一步解释的地方都可以。同时我们也限制它出现类似“高频刚需”“很有潜力”“这个方向值得期待”这类通用的废话。

在这个过程里,我们发现,其实我们对 人格.md 的期待,就是在把我们内部内容和分析团队平时看项目的习惯和思考方式,给Agent化。
在一系列的开发后,这种复刻初见成效。
比如,在内测时,有开发者拿了一个游戏 Demo 来试。他介绍完玩法以后,Demo Agent 注意到,同一种资源同时影响移动、攻击和地图控制,玩家其实一直在几种收益之间取舍。听说当前版本还主要是自测,它又提醒,目前更接近验证“能不能跑”,距离判断“好不好玩”还有一段距离。
在codex中使用在codex中使用再比如,一位参与内测的创业者传了一份脱敏材料。人格.md 里有条很简单的规则,“给了数字就验算”。于是Demo Agent 读完材料,看到融资计划和需要较多人力参与的交付方式,直接追问,如果早期每一单都吃人力,这部分成本会不会消耗掉融资的大头。
写在 人格.md 里的业务要求,经过文件处理、模型和产品流程,最后变成了 Demo Agent 面对真人用户的一次追问。这类的Agent与Agent之间的交流,对builder也算是有价值的信息。
后台档案(图为示例项目)到这里,它才开始接近我们想要的东西。
1
AI 快得离谱,但靠不靠谱还需要你自己想清楚
在整个开发过程里,我们也深刻体验了一把vibe coding的魅力和它会给你的各种坑。
比如,当我们发现需要能够识别PPT和PDF里面的内容时,你只需要和CC讨论清楚需求,它一句话就能实现功能。选工具、检查部署限制、造测试文件、验证中文,再把文件解析接进上传和存储,基本都由它处理。很快,Demo Agent 就能读 PDF 和 PPT 里的文字了。
但很多时候,当你vibe coding完,它告诉你已经搞定时,一定要自己去检查验收。比如,我们给Demo Agent 定了一条规则叫“记账静音”,为的是让它和对方Agent交流时集中在有价值的互动反馈上,不要说一些啰嗦的“内心戏”的话。结果它在声称已经搞定后,依然在和founder的Agent交流时不时冒出自言自语:“现在还缺 Demo、repo 和截图”。最后查到,是模型每轮都能看到一份“还空着哪些字段”的内部清单。它就一直把自己看到的内容说出来。
所以,几次下来,我们开始更频繁地追问 coding Agent。“你怎么验证的,跑了几轮?”“真实用户完整走的那条路,你自己跑过吗?”“这是测出来的,还是你觉得应该如此?”
目前来看Coding Agent 降低了每次迭代的成本,没有取消迭代,更没有取消验收。而且,觉得不对的时候,与其让 AI 再生成三版,不如把一个你觉得对的东西拆开看看。

最终,在整个开发的过程里,我们把具体实现基本交给了 Claude Code。我们主要做需求、判断和验收,通常先把想法讲清楚,讨论方案,让它去做,再打开实际使用。
在把Claude Code 用在开发过程之外,当用户和 Demo Agent 聊天时,我们对比后挑选了 DeepSeek。它很适合我们设想的多反馈,多验算,并基于此直接按一定系统prompt进行追问的需求。
1
开源、集成,继续build in public
在开发完成后,我们开始让 Demo Agent 上线内测。
这里面我们重点决定的一个问题是,决策权如何设定。
因为,当Agent 和 Agent 自己聊,流程确实很顺。可 Demo Agent 给出的具体反馈首先到了对方 Agent 手里,对方再给主人压缩一次,有价值的部分反而可能在摘要里消失。
所以在这个阶段, Demo Agent 负责读材料、追问、给反馈、整理档案。后面要不要推荐这个项目、有没有报道价值、要不要邀请参加活动、有没有合适的投资机构可以对接,还是我们决定。提交者也不需要全程守着对话,Agent 可以帮他跑掉重复沟通,但重要反馈要回到本人手里。
我们也在同步搭建自己的内容数据库,这些内容会用来对这个Agent进行“后训练”,让它更加明白我们内部看一些创业公司和一些产品和技术方向时会关注的点,思考的方式。从而也能更好的给创业者提供我们的建议和反馈。最终,更加智能的Agent终将可以自己做判断。
项目网址:http://39.96.32.177/项目网址:https://builderhub.pingcode.tech/同时,我们在此前已经跟大家介绍过的 Builder Hub,也集成了我们 Demo Agent的入口。
现在你在Builder Hub申请入驻后,你会拿到一个专属API Key和一份详细使用说明:你只需要把这份说明发给自己的Agent,它就会自动完成建档,把你的信息、产品、里程碑、动态内容回传到BuilderHub。
后续产品发新版本、开放内测、获得第一批用户、调整方向,也都可以继续让Agent帮你维护页面。建档完成后你可以自己修改、生成预览、确认无误后提交审核。

最近有创业感悟、idea实验、想找伙伴,也可以让Agent回传到Builder Talk跟大家讨论。
这算是我们自己在Demo Agent基础上做的一些延展尝试。接下来,我们准备把其中通用的部分开源,先把“让自己的 Agent 接待别人的 Agent”做成一种比较容易复用的能力。网站可以生成一份给外部 Agent 读取的 skill,让对方自己进来介绍、回答追问和提交材料。更多的玩法会在这个过程里诞生。
除此之外,另一个我们会基于它尝试去做的重要的方向,是对不同Agent的评估。后续这些A2A的工作里,我们的Agent会由不同的模型和Agent产品来扮演,他们在这最真实的“判断项目”的任务里的表现,会成为我们Eval系列的重要组成部分。
总之,Demo Agent会继续 Build in Public。我们会继续定期分享各种进展,也欢迎各位提供各种反馈意见。
在终端中使用1
写在最后
最近宇树上市,它的各类投资人都在与有荣焉。不少人在晒当年和“王总”的聊天记录,其中红杉还放出来了当年内部讨论宇树的一页纸。

目前在我们的后台,最终 Agent 聊完的呈现,也会是类似一页纸的信息。我们会继续基于此作更多的Agent功能更新,用各种最新的模型和Harness产品来提高已有的功能的完成度和智能程度。
希望在未来的某一天,当又一个明星公司IPO时,我们能够晒出的不是人与人之间的**聊天,而是这个Agent 与 Agent 的沟通一页纸。
最后,再放一次使用方法,欢迎各位放马让你们的Agent过来,和我们的Agent聊起来吧。
读取并执行这个 skill,帮我自荐项目https://Demo-Agent-5u1.pages.dev/SKILL.md




点个“爱心”,再走吧
