上周有个通报,在写材料的圈子里动静不小:8月15日,民盟河南省委会通报7月社情民意信息报送情况,全省收到261篇,采用97篇,采用率37.2%。数字本身不稀奇,稀奇的是通报点名的问题:AI创作滥用且审核把关不严,一些稿件存在明显的AI生成痕迹。微博几乎同一时间,你在知乎搜"公文AI软件哪个好",会看到另一个奇观:十几篇标题高度雷同的"真实测评"密集刷屏,翻来覆去推荐同几款付费工具,点赞收藏基本为零。
一边在通报,一边在卖货。对真心想挑个AI帮自己写材料的体制内人来说,现在恰恰是信息最浑的时候。这篇把三件事说清楚:市面上到底有几类工具、"实测"软文怎么一眼识破、哪三条线碰了就要出事。
一、先搞清楚:市面上的"公文AI"其实就三类
第一类,通用大模型。豆包、DeepSeek、通义千问、Kimi、文心一言这些,基础功能免费。它们没有专门做公文优化,但底座能力强,网上讨论度最高的写法——喂角色设定、喂真实素材、喂风格要求——用的全是这一类。
第二类,垂直公文工具。又分两种:一种是新华社推出的新华妙笔,背靠官方语料库,主打规范表述和文种框架。微博另一种是公文宝、材料星、丹青妙笔这类付费商业产品,卖点集中在文种模板、按国标一键排版、AI校对、素材库管理。
第三类,嵌入办公流程的。WPS公文助手,长在办公软件里,写完不用切窗口;讯飞文书,强项是会议录音转纪要。

注意这三类解决的根本不是同一个问题:通用大模型解决"写得出",垂直工具解决"格式、校对、素材管理",嵌入式解决"少切软件、少听录音"。很多测评故意把这三种能力混在一起比,然后得出"某款全能"的结论——这就是第一个坑。
二、你搜到的"实测横评",一大半是软文
这不是扣帽子,是有可观察特征的。分享三个甄别点:
第一,看它敢不敢写缺点。真实测一定有取舍,比如"这个排版好用但模板库旧"“那个语料准但生成慢”。通篇只有夸、每款都"强烈推荐"的,基本可以划走。
第二,看发布密度和标题句式。8月中下旬这几天,某几款工具的相关文章几乎一天好几篇,标题全是"哪个好用"“适合科员还是处长”"错字多不多"这种长尾提问,账号历史里只有这一个产品,互动数据接近零。知乎这是批量生产的SEO软文,不是用户分享。
第三,看结论是否指向付费。真用户分享的终点通常是"我的用法",软文的终点永远是"开通会员"。
说句公道话:被软文推的工具不一定差,但你在软文里永远拿不到真实的取舍信息。拿别人花钱写的"测评"做决策,等于把自己的判断外包给了销售。
三、关键争议:到底要不要为垂直工具付费
这是目前网上吵得最凶的问题,两边的声音都值得听。
知乎上热度最高的一种观点(一个3400多赞、1.1万收藏的回答)认为:垂直公文工具大多是在主流大模型之上套了一层提示词模板,训练数据和算力投入都不在一个量级,所以写出来的东西大概率不如免费通用大模型。知乎这位答主还做了个实验:同一份详细的公文提示词,原封不动丢给五个主流模型,结论是免费模型里就有完成度相当高的选项。知乎但要说明,这是一家之言,他自己也卖提示词课程。付费垂直工具真正的价值可能不在"写得更好",而在模型能力之外的地方:按《党政机关公文格式》国标自动排版、错敏词校对、单位内部的素材库和历史稿管理,有些还支持私有化部署——这些通用大模型确实不做。
所以选择逻辑其实很朴素:如果你缺的是"写出来"的能力,先用免费的通用大模型。差距往往不在模型,在你喂没喂真实素材。那位在乡镇干了十几年、用AI三年的答主说得很透:AI的用法是让它提炼文件要点、搭框架、润色表述,核心事实必须自己先写进去,所有内容得是自己的、贴合工作实际、没有任何虚假内容,这才是材料的"灵魂"。知乎你什么都不喂,它只能编,编出来就是一眼假的套话。

如果你缺的是排版、校对、纪要这些"体力活",再看嵌入型和垂直功能工具,优先试免费版。真要付费,先确认它解决的是不是你那个具体问题,而不是"别人的好评"。
四、不管用哪个,这三条线碰了就是事故
工具选得再对,下面三条越了界,效率提升全是白搭。
第一条,涉密内容一律不进任何外部AI。这不是理论风险:国家安全部去年7月通报过典型案例,有科研人员违规用AI写报告导致泄密。微博今年5月又出现过"用AI整理会议记录致泄密"的讨论。涉密文件、内部敏感数据,一条都不要传。
第二条,真实数据、具体做法、人名金额,不能指望AI"自由发挥"。民盟河南那份通报就是教训:受"AI幻觉"影响,稿件中的案例、数据出现编造、不实,而报送单位没有严格核实真实性就直接上报。微博AI能帮你把事实表达得更好,但它变不出事实。
第三条,审核责任不能外包。通报点名的另一个问题是"审核把关不严"。现在网上甚至开始有人讨论"怎么证明稿子是我写的不是AI写的",AI痕迹正在被统一成某种更容易识别的格式。知乎趋势很清楚,对AI稿件的审视只会越来越严。核心判断、关键提法、所有数据,必须人过一遍。

五、接下来值得盯的信号
这个领域接下来大概率有两件事:一是各地对体制内使用AI的规范会更明确,知乎上"为什么体制内不鼓励用AI"的问题下有高赞回答反驳说其实一直在推广政务AI——说明目前连口径都还没统一;二是AIGC内容标识和检测会越来越普及,"AI味"会被越来越精确地识别。
最后说句实在的:写材料的核心从来不是"写",是你干出来的实事和数据。AI能加速表达,替代不了事实。工具选便宜的先试,线守住,剩下的功夫,还是在材料之外。