嘴一说它就动手:ChatGPT语音开始替你办事了
这两天不少人发现,跟 ChatGPT 说话,它不光会答了,还会动手了。
9 月 23 日,OpenAI 把实时语音模式接上了插件和已连接的应用。邮件、日历、Slack 这些你之前授权接好的东西,现在张张嘴就能让它去查、去办。官方演示里有个挺唬人的例子:它自己翻财务应用,找出重复扣的款,然后动手取消。网页、iOS、安卓都支持,免费版和 Go 用户也在覆盖范围里,能用哪些插件看你自己的套餐。

我看明白这事儿之后,第一反应倒不是惊叹,是想起家里雇过钟点工的都懂的一个理儿。
你给阿姨交代活儿,有两种方式。一种是写张条子放桌上:买什么菜、交什么费、几点接孩子。条子写好了,你出门前还能拿起来再看一眼,写错了顺手划掉改过来。另一种是隔着院子喊一嗓子。话一出口就收不回来了,阿姨手脚麻利,听见就干,等你下班回来,才发现酱油买成了醋。
打字,就是那张条子。你敲完指令,屏幕会先给你看一遍:邮件草稿、要改的日程、要删的会,都在那儿等你点头。那一眼,就是你的刹车。用嘴说,没有这一眼,话说完它就开始办了。

替它说句公道话,OpenAI 留了一道硬闸:真要动钱、动授权这类敏感操作,屏幕上会弹出来,必须用手指点同意或拒绝,光靠嘴上说「行」不作数。这道闸没拆,值得肯定。可大量中间地带的事——发一封信、挪一个会、删一条记录——嘴一快,就已经办完了。

还有两层容易忽略的账。一层是,语音这条新通道,用的还是你原来那份授权,很多公司限制 AI 能碰哪些应用的规矩,白纸黑字写的都是打字指令,语音是刚开的口子,制度还没跟上;另一层是,你在 ChatGPT 里改了权限,不等于外头那个应用的授权就撤了,真要断,得回到原服务里把连接解除掉。
听老舅一句劝,把这玩意儿当成腿脚勤快、耳朵有点背的帮手来使。查东西,放心让它跑——今天几个会、邮件说了啥,查错了你一眼就能看出来,代价可逆。要改东西,回到打字,让它把草稿亮在屏幕上,你过目再点头,多花十秒,比事后挨个道歉便宜。还有一句最便宜的保险,不花一分钱:开口之前先加一句「你先说说你打算怎么干」,让它把计划报给你,听完再让它动手。
语音能办事,确实是把 AI 从陪聊变成了帮手,这步是实打实的进步。但越是手脚麻利的帮手,越得给它立规矩。交代人办事,写张条子总比隔着院子喊一嗓子稳当——话出了口收不回来,条子还能再看一眼。
