一个人能做有声书吗?做了一年,说说我看到的真实情况
做了刚好一年了,想找个地方复盘一下,顺便给想入行的人看看真实情况——网上那些"月入过万"的帖子,有一半是割韭菜的。
为啥开始做这个
去年这时候我在一家小公司写文案,月薪8000,饿不死也富不了那种。下班就刷手机,有天刷到一个人说他自己做有声书,副业月入过万。
我当时眼睛就亮了。
说实话我条件一般:没学过播音,声音就普通人水平,音频后期更是零基础,手里能投的钱也就两千块。这个条件放在三四年前?别想了。要么花钱请人配音,光配音费一本书好几百;要么自己报班学播音再学后期,光入门就得好几个月,学费也得大几千。
但我运气好,赶上了工具集中爆发的时间点。
第一个月:从零到第一本书上线(折腾了五天,差点放弃)
刚开始完全两眼一抹黑。上网搜教程,好家伙,传统流程是这样的:拿到版权文本→手动画本(就是标注角色、分配台词)→找人配音或者自己录→后期剪辑加音效→逐字审听校对→导出上架。
一本书少说要搞一个月。
我不信邪,自己试了试手动画本。打开一个10万字的网文,光是理清谁是谁、谁说了哪句话,两天就过去了。然后找人配音——问了几个配音群,单播最低30块一小时成品,一本书下来好几百块。我预算就两千,这条路明显走不通。
后来在一个创作者群里有人提到万象有声(audimind.com),说可以一站式做有声书。我注册了账号,心想这下终于能开干了。

结果第一个下午直接被教做人。
你以为上传文本就完事了?不存在的。
画本环节就炸了。我上传了一本网文,拆章倒是成功了,但画本结果出来我看了一眼就傻了——系统把两个完全不同的人标成了同一个角色,旁白和对白的界限也划得乱七八糟。我也不知道是文本的问题还是系统的问题,在后台翻帮助文档翻了半天,啥也没找到。
最后没办法,硬着头皮去找万象有声的客服。说真的我没报什么期望,以为客服会甩个链接给我打发走。结果还真帮我看了,让我把文本文件发过去,看完告诉我:你的章节格式不统一,有的写"第一章",有的写"第1章",系统拆章识别就乱套了。然后客服帮我在后台调了拆章规则,重新跑了一次画本——这次角色识别就正常了。
那一下我心情好了一大截。
但问题还没完。后面我又陆续找客服问了好几次:音色到底怎么选才适合不同角色?AI配音的情绪参数调多少合适?审听标注里那个"多录"是什么鬼(后来发现是我文本里有段重复内容,不是AI读多了)……基本上每走一步卡一下,就去找客服问一次,问完继续干。
就这么搞了五天,五天啊,第一本书10万字才做出初稿。AI配音加画本,总成本80来块钱。我自己通听了一遍,改了几个读着别扭的地方——其实就是AI读错多音字和专有名词,手动重新生成了那几段。第二天上架了。
第一本书品质确实糙,糙到我自己都不好意思听第二遍。但是!重点是——我把整个流程跑通了。一年前这事我想都不敢想。
那天晚上我发了条朋友圈,虽然只有三个赞,但心里是真的高兴。
等一下,书的版权从哪来?
上面说得好像挺顺的,但其实有个大问题我一直没提:你做有声书,文本哪来的?版权怎么办?
这是我刚开始最懵的事。你不能随便拉一本网文就开始录——没授权就上架,轻则下架,重则被告。我有个朋友,录了一本热门小说,上线三天就被版权方投诉了,一周白干。
这个坑我踩之前先了解清楚了,版权来源大概有这么几条路:
1. 公有领域作品(零版权风险,适合练手)
就是版权保护期过了的作品,谁都能用。国内是作者终生加50年,所以古典文学基本都在这个范围——《红楼梦》《西游记》《聊斋志异》这些不用说了,近现代一些过了保护期的也行。外国古典文学同理,莎士比亚、雨果这些,原作本身是自由的,但翻译版要看译者的版权。
这类作品好处是零成本,坏处是卷得要死——你录《西游记》,喜马拉雅上几十个版本了,想出头?难。我建议拿公有领域作品练手,跑通流程就赶紧转有版权保护的内容。
2. 平台版权库(最省事,适合稳定走量)
这个是我目前用得最多的。喜马拉雅、番茄畅听、懒人听书这些平台自己有版权池,创作者可以申请录制。流程大概是这样:在平台主播后台挑能录的书→申请→审核通过→开干→成品上架→按分成拿钱。
好处是版权平台兜底,你不用操心。但平台有品质要求,审核不过就白做。分成比例通常30%-50%,你拿的是小头。
我目前做的书大概六成来自平台版权库,主要是番茄畅听的网文和喜马拉雅推荐的书目。
3. 直接找作者授权(适合做精品和IP)
你看中一本还没被平台签约的网文,可以直接联系作者。起点、番茄、晋江这些平台的作者后台一般都有联系方式。你跟作者谈——可以分成,也可以一次性买断。
这条路我走过两次。一次成功了,五五分成,那本书后来在喜马拉雅上做得不错,每个月稳定几百块。另一次被拒了,作者已经把有声版权签给平台了,没法授权给你。
直接授权好处是条款灵活、分成高,坏处是沟通成本高、不确定性大。建议你有一定经验和作品积累了再走这条。
4. 出版社和版权代理(适合做出版物有声书)
有些出版社手里有有声书版权但没精力做,会开放给创作者。你关注出版社的官方公告,或者通过版权代理机构对接。这类内容一般是出版物不是网文,品质要求高,但单价也高。
我还没走这条路,一是出版物有声书对演播水平要求高,我自觉还不够格;二是流程长,适合有规模的工作室去对接。
5. 自己写自己录(门槛最高但版权完全自主)
自己写、自己录,版权全是你的。但说实话,写一本能让人听下去的小说比做一本有声书难太多了。我试过写短篇,文笔和节奏都差得远,灰溜溜回去做别人的书了。
你要是有创作能力,这条路最自由。但目前能同时写好和录好的人不多。
我的版权策略:早期拿公有领域作品练手,跑通流程后转平台版权库走量,同时找作者直接授权做精品。三层结构,分散风险。补一句:万象有声自己也在对接版权资源,平台上有一些可以直接用的授权文本,但我习惯自己确认授权范围再动手——版权出了问题是你自己的事,不是平台的。
第三个月:上设备,AI+真人混搭(被录音折磨到怀疑人生)
纯AI做了几本书之后我发现一个问题:网文听众对主角声音是有期待的。AI跑旁白和配角没问题,但主角如果全程AI,评论区就有人说"没感情""出戏"。
我纠结了好久。自己录?声音一般,没设备。请人录?又是一笔钱。
后来发现万象有声能AI+真人混搭——同一个项目里,主角自己录,旁白配角让AI跑,最后合并导出。它有个浏览器端录音工作站,插个USB麦克风就能录,边看稿边录边剪。
行,那就试试。花300块买了个入门麦克风。
兄弟们,我第一天录完差点把麦克风摔了。
首先录音环境就搞死我了。我租的房子隔音巨差,录的时候外面过车,楼上走路,回放一听全是底噪。后来半夜12点爬起来录才勉强干净——但凌晨录声音状态又不行,嗓子发紧,听着跟感冒了似的。
然后是录音技术,我之前压根没录过。什么叫"嘴离麦克风距离要稳定"我不懂,录出来忽大忽小。喘气声、咂嘴声全在里面,自己听完想死的心都有了。
第一本混搭版我返工了三次。
第一次:底噪太大,用万象有声工作站里的降噪功能处理了一遍,勉强能用了。
第二次:AI音频和真人录音音量不统一,拼接的地方明显跳了一截,跟换了个台似的。又去找客服,客服说项目里有统一音量处理选项,我之前压根没注意到……翻了一下设置才发现,确实是有的。
第三次:主角有段哭戏,我怎么演都不对,录了十几遍自己都觉得假。最后那几段还是用AI跑的,换了个带哭腔的音色——你别说,效果居然比我自己录的好。那一刻心情很复杂。
混搭模式真正跑通花了整整两周。前一周全在踩坑,后一周才找到感觉:录音前关窗、关空调、手机静音;嘴离麦克风一拳距离;录完先降噪再调音量;AI和真人音频在项目里统一处理,不用手动搞。
等第一本混搭书上架到喜马拉雅,第一个月分成287块的时候,我截图发给我妈了。我妈说"才两百多啊"。但我知道,这287块意味着什么——这事儿能赚钱,不是玩玩。
第六个月:算是找到节奏了(但还是踩了两个大坑)
到第六个月,流程基本稳了。说说产量和收入:
产量:每月4-6本,每本8-15万字。大概一半混搭一半纯AI(短篇、配角多的快节奏网文用纯AI)。
制作时间:一本10万字的,混搭大概2天(画本1小时+AI配音半小时+自己录主角4-6小时+审听1小时+修整1小时)。纯AI半天搞定。
成本:AI画本2积分/万字,一本10万字约2块钱。AI配音7.9元/万字,一本10万字约79块(混搭实际更少,AI只跑旁白配角)。平台会员几十块一个月。单本总成本混搭50-80块,纯AI80-100块。
收入:月分成3000-5000块。大概六成来自喜马拉雅,三成番茄畅听,一成其他。
但这个钱不是一上来就有的。中间有两个坑差点让我放弃。
第一个坑:前两个月做了本历史网文,纯AI,提交番茄畅听审核,被拒了。理由是"AI痕迹明显,角色辨识度低"。那本书成本直接打水漂,两天白干。
我当时的反应是:????
后来才搞明白,番茄畅听对AI配音接受度比喜马拉雅高,但前提是音色得搭——历史类用沉稳男声,言情类用清亮女声,不能一本书从头到尾一个音色打天下。被拒之后我重新搞了套多角色音色方案重新生成,第二次审核就过了。但第一次那本的时间精力是真浪费了。
第二个坑更扎心:有一本书在喜马拉雅上架后两个月,播放量才200多。分成收入不到10块钱。
那本书我花了三天做混搭版的。三天换10块钱,你说扎不扎心。
后来复盘了一下,是选书的问题——那本小说在文字平台上本身就不火,做成有声书也没人听。选书比制作重要,这句话我是花了真金白银才学到的。以后选书之前一定先看原作在平台的数据,不火的坚决不碰。
是的,没有月入过万。但我也没全职做——每天大概花3-4小时,剩下时间还在上班。
第七、八个月:开始跟人合作了(原来最累的不是技术,是人)
到第七个月的时候,光靠自己录主角已经跟不上了。量一上来,嗓子也扛不住——一天录四五个小时主角,第二天起来嗓子哑得说不出话。
而且有些书的主角类型真不是我的声线能驾驭的。中年大叔、少年音、反派,我自己录出来全一个味儿。得找人合作了。
我在配音群里发了招募帖,陆续来了不少人。这下我才知道,做有声书最累的环节根本不是技术,是跟人打交道。
先说催音这件事。
你以为找了个配音员,约好三天交音,他就会三天交?天真。
我合作过的配音员,大概能分这么几类:
第一类:靠谱型。说三天就三天,质量也过得去,偶尔还能提前交。这种人是宝贝,我手里就两三个这样的,每次有活儿都先紧着给他们。但他们的档期也满,经常排不上。
第二类:人间蒸发型。接了活儿,头两天还回消息,第三天开始人间蒸发。微信不回,语音不接,你发十条消息过去像石沉大海。你心里慌得不行——因为平台那边deadline在催你,你两头受气。
有一回我找了个人录主角,约好五天交。第三天开始联系不上,我急得不行,每天早中晚各发一条消息问进度,语气从一开始的"哥进度咋样了"到后面"兄弟你还在吗"再到最后"你要是不做了跟我说一声我找别人"。第六天他突然回了——"不好意思这两天有点事"。然后把音发过来了,质量一塌糊涂,底噪大得跟在菜市场录的似的。
那次我差点没忍住骂人。但骂人有什么用呢?deadline是你自己的,平台不管你什么理由,超时就扣信用分。
第三类:质量不稳定型。态度很好,人也积极,但水平忽高忽低。同一本书前五章录得挺好,第六章突然就不行了,可能是状态不好或者累了。你让他返工吧,他说好,改完发过来还是不行。来回折腾三四次,你都不好意思再开口了,人家也挺不好意思的。
第四类:自我感觉良好型。这种最头疼。录完发给你,你一听,感情不对、节奏不对、好几个地方读错了字。你委婉地提意见,他回你一句"我觉得这样处理挺好的呀"。
你跟他说"这段是主角得知亲人去世,情绪应该是崩溃的,不是平淡地念",他说"我理解你的意思,但我觉得含蓄一点更好"。
哥,这不是你理解的问题,是甲方要的东西,你含蓄个什么劲儿啊。
但你还不能太硬,太硬了人家直接撂挑子不干了,你更抓瞎。你得哄着来,"哥你看要不这样,这段咱们再试一版,上一版其实挺好的,就是情绪上再给一点,一点点就行"。跟哄小孩似的。
催音最崩溃的一次:平台那边限15天交音,我在第十天还没收到配音员的音。每天催,每天催,对方就是说"快了快了"。到第十三天终于发过来了——只有一半。说另一半明天给。第十四天另一半来了,但格式不对,还是单声道低码率的。又让他重导。第十五天卡着deadline交了上去,我审听的时候发现有三段读串行了——跟原文对不上。
我当时坐在电脑前,盯着屏幕,深呼吸了好几次。
那本书最后勉强过了审,但我心里清楚质量不行。后来那本书在平台上的评分也是我所有书里最低的。读者评论说"主角有时候听起来心不在焉"——他确实心不在焉,因为录音的人心也不在。
再说平台限时交音这件事。
很多人以为做有声书就是"慢慢做,做好了上架",不是的。你从平台版权库申请到的书,基本都有交音期限。番茄畅听一般是15-30天,喜马拉雅有些书给7天,很短。超时会怎样?轻则扣信用分,信用分低了以后申请不到好书;重则书被收回,你前面做的全白费。
这意味着什么?意味着你同时在做的三四本书,deadline可能挤在一起。你手里有两本书都是这周交,一本主角音还没录完,另一本审听发现一堆问题要返工,配音员那边又联系不上——这时候你真的会想撞墙。
全职之后这种情况更频繁。有段时间我同时接着五本书,脑子里全是deadline。每天早上睁眼第一件事就是看哪个配音员回了消息,哪本书还差什么环节。我老婆说我说梦话都在催音。
后来我想了个办法:在万象有声上把多个项目分开管理,每个项目标注deadline和当前进度,哪个卡住了就重点盯哪个。配音员那边我也学聪明了——接活儿之前先问档期,约交音时间留两天缓冲,合同里写清楚超时怎么处理。但即便这样,催音这件事还是省不掉的,因为人不是机器,你永远不知道对方什么时候会掉链子。
最忙的一周我连续五天没在凌晨两点前睡过觉。那周交了三本书,赚了大概两千多块。算下来时薪跟上班差不多,但精神压力大太多了——上班你摸鱼一天也没人管你,做有声书你少干一天deadline就少一天。
第十个月:辞职了(全职之后心态完全不一样)
到第十个月,月收入稳定在6000-8000,赶上上班工资了。犹豫了一周,辞职了。
说实话按下辞职信发送键那一刻,心跳得很快。
全职之后产量上来了,每月能做8-12本。收入也破了万。但全职和兼职心态完全不同——兼职的时候一本亏了就亏了,全职之后每一本都要算投入产出,不然下个月房租怎么办。
而且全职之后,催音的压力放大了好几倍。兼职的时候一个月做四五本,就算某本配音员拖了,大不了我晚几天交,顶多扣点信用分。全职之后一个月十来本,每本都有deadline,配音员但凡有一个掉链子,后面全线连锁反应。
有段时间我手机一天到晚响,全是配音员的消息——有的问"这段怎么处理",有的说"今天嗓子不舒服明天录",有的直接消失三天才回消息。我变成了全职客服+催音专员+情绪安抚师。有一天晚上我数了一下,光跟配音员沟通的消息就发了上百条,自己一行字都没录。
几个变化:
选书挑了很多。不是什么书都做了,优先选有版权有流量潜力的。纯AI走量,混搭走口碑,两条线都得有。
但选书也踩了坑。有一本我看数据不错就接了,结果全是修仙术语和自造词,AI配音读得惨不忍睹——"缥缈宗"读成"漂渺宗",一些多音字也读错。光重新标注发音就花了大半天。后来学乖了,接书之前先扫一遍文本,看专有名词多不多,多的话要么不接,要么提前在万象有声的发音字典里标好。
声音克隆用上了。有些系列书主角声音要跨书统一,我就用万象有声的声音克隆——录一段1分钟样本,克隆出专属音色,后面所有书主角都用这个声音。听众听着像同一个人,IP感就出来了。
但克隆也不是一次成的。我第一次用的样本有底噪,克隆出来的音色带着一层沙沙声,没法用。重新在安静环境录了干净样本才过关。后来客服跟我说样本质量决定克隆质量,1分钟样本要尽量覆盖你平时说话的音域和语速变化,别光念一段平的。
审听不敢偷懒了。兼职的时候有时候跳过审听,全职后绝对不敢。有一次偷懒没审就交了,甲方收到发现第二章整段漏读——AI生成时网络断了导致一段空白,我没发现。甲方没说啥,但我自己脸都红了,后来再也不敢跳。万象有声的AI审听会把音频和原文逐字比对,标出读错漏读,看完标注重点听那几段就行。以前人工审听一本三四个小时,现在半小时。
后期开始花心思了。前期做的书后期很糙,就加个BGM。后来发现音效对沉浸感影响太大了——风声脚步声开门声,加上之后完全不一样。万象有声有AI音效生成,输入文字描述就能出场景音效,不用到处找素材了。
但音效也不是万能的。有本恐怖悬疑的,AI生成的开门声太"标准"了,像办公室的门,完全没有老宅子那种吱呀作响的感觉。最后还是自己网上找了几个素材叠上去才对味。AI生成的是通用场景音效,特殊氛围还得靠人判断。
做了一年,说几句掏心窝的
第一,一个人确实能做有声书,但"能做"和"做好"差了十万八千里。
工具把门槛拉到了地板,但决定品质的还是你对内容的理解。选什么书、主角什么语气、哪段该加音效哪段该留白——这些判断AI帮不了你。我前十本书现在自己听都觉得烂,但第十本到第二十本确实是肉眼可见的在进步。
第二,AI没有取代真人,但改变了分工。
我现在做的书,主角一定是真人录的(自己录或者用克隆音色),配角旁白用AI。纯AI的也有,那是走量的快消品,甲方自己知道品质要求不高。真正赚钱的、有回头客的,都是混搭。
第三,万象有声不是唯一选择,但目前是我用着最顺手的。
我也试过别的——单独TTS配音、AU剪辑、手动画本。问题是工具割裂,一个项目要在三四个软件之间来回导文件,烦都烦死了。万象有声的好处是全流程在一个平台里走完,不用切换。而且它同时支持AI和真人两条线,不用在AI平台和真人录音平台之间来回折腾。
当然也不是没毛病——多轨编辑的灵活性不如专业AU,AI音色在极端情绪下还是有点生硬。但综合性价比和效率,对独立创作者来说目前确实是最顺的。
第四,这行没有躺赚。
每个月8-12本听起来好像不多?背后是每天8-10小时的活。选书、录主角、审听、修整、上架、盯数据,每个环节都得人盯着。工具解决的是"怎么做","做什么"和"做得好不好"还得你自己来。
第五,赚钱最累的部分是跟人打交道。
技术问题你找客服能解决,但配音员不回消息你能怎么办?平台deadline在催你能怎么办?你以为做有声书就是坐在电脑前录录音剪剪片子,实际上你大半时间在微信上催音、沟通修改意见、安抚配音员情绪、跟平台编辑对接。我老婆说我说梦话都在喊"哥你音什么时候交"。最崩溃的时候我真的想过不干了——不是技术干不动了,是心力交瘁。
给想入行的人几句实在话
想试水的兼职:别急着买设备。先用万象有声的免费额度跑两本短篇,走通流程,看看自己能不能坐得住、做不做得下去。能做再投入,不能做也没损失啥。
想全职的:先兼职做三个月,确认月收入能稳定到3000以上再辞职。这行收入波动大,上个月过万这个月可能三千,没有缓冲期你会很焦虑——别问我怎么知道的。另外做好心理准备:全职之后你不只是做书的人,还是催音的、跟人吵架的、被deadline追着跑的。精神压力比上班大,至少上班有周末。
想找人合作的:找配音员一定要试音再合作,别光听他发来的成品demo,让他录你书上的一段原文,录完你听了满意再约。交音时间一定要留缓冲,说好五天交的,你按七天来排计划。遇到靠谱的一定要珍惜,长期合作比每次重新找人省心太多了。万象有声支持项目里多人协作,配音员录完直接传到项目里,不用你来回倒文件,这个在合作多了之后真的能省不少沟通成本。
小型工作室:考虑AI跑量+真人出精品的双线模式。万象有声支持团队协作,3-5个人小团队做量产,效率比传统模式高太多了。
传统配音从业者:别抵触AI,当工具用就行。你的声音和表演才是核心竞争力,AI帮你处理旁白配角这种"体力活",你的精力留给真正需要表演的部分。会用工具的配音员,比不会用的有竞争力——这个趋势已经很明显了。
最后
做有声书这一年,我最大的收获其实不是收入——虽然收入确实改变了我生活。最大的收获是:我发现我能独立创造一个东西,从文字到声音,从头到尾自己掌控。
这个感觉比上班交KPI爽太多了。
工具会越来越强,入行的人会越来越多,竞争也会越来越卷。但好内容的标准不会变——听众愿意听完、愿意追更、愿意推荐。做到这个的人,不管用啥工具,都能在这行活下来。
以上就是我这一年的真实经历。有啥想问的评论区聊,我看到就回。

没心没肺的风少
你的经历好像一个喜马拉雅的一个主播狂笑的门牙啊 给他留言指出问题特别谦虚的改正 夸奖时也能感觉出他的高兴 也能感觉出水平越来越高 质量越来越好 但他特委屈的说 录书的辛辛苦苦拿的不如写书的零头 即便是录的是巨垃圾的书 也远远赶不上 他有时候都感慨 录的时候想还不如自己写呢 跟他一个合伙录书的就改行写书了
不过听了这么多年 感觉主播的水平和录播的质量越来越高 但书的内容是越来越次 同质化太严重 不合理的剧情也听着糟心 各种种马 绿茶表 道德婊 小白文越来越多 最开始是还跟着评论 夸奖和批评 后来开始谩骂 到最后我都无视了 听什么就为听个音 根本不过脑子了
尤其是喜马拉雅政治审核越来越严格 很少能有带深度的小说 但是各种民间粗话俚语有点放开了 感觉有点接地气了 总算是唯一的一点进步
校验提示文案
没心没肺的风少
你的经历好像一个喜马拉雅的一个主播狂笑的门牙啊 给他留言指出问题特别谦虚的改正 夸奖时也能感觉出他的高兴 也能感觉出水平越来越高 质量越来越好 但他特委屈的说 录书的辛辛苦苦拿的不如写书的零头 即便是录的是巨垃圾的书 也远远赶不上 他有时候都感慨 录的时候想还不如自己写呢 跟他一个合伙录书的就改行写书了
不过听了这么多年 感觉主播的水平和录播的质量越来越高 但书的内容是越来越次 同质化太严重 不合理的剧情也听着糟心 各种种马 绿茶表 道德婊 小白文越来越多 最开始是还跟着评论 夸奖和批评 后来开始谩骂 到最后我都无视了 听什么就为听个音 根本不过脑子了
尤其是喜马拉雅政治审核越来越严格 很少能有带深度的小说 但是各种民间粗话俚语有点放开了 感觉有点接地气了 总算是唯一的一点进步
校验提示文案