AI能画蒙娜丽莎却写不好“人”字?华中科技大学捅破这层窗户纸
源自22位全网作者
07-21 18:26
精选参考来源
1
华中科技大学团队突破文字图像生成难题:TextPecker让AI告别“错别字”时代
2
你用Midjourney、Stable Diffusion生成带汉字的图,结果出来的字要么缺笔画,要么像外星文,要么直接是乱码。这不是你提示词写得不好,是AI根本不懂汉字。
原因一:训练数据的结构性缺失
主流AI绘画模型的训练集以英文为主,汉字样本占比极低。更致命的是,模型学习的是"像素模式"而非"文字语义"。它知道"apple"对应一堆像素,但"苹果"两个字对它来说只是随机笔画组合。没有语义理解,就没有正确生成的基础。
原因二:汉字本身的复杂度碾压
英文26个字母,汉字常用字就有3500个,且每个字都是独立的高维图形。横竖撇捺的细微差别决定字义,而AI的生成机制是"概率预测下一个像素",面对这种精密度,它天然吃力。一个"未"和"末",AI可能觉得"差不多"。
原因三:渲染机制的字形崩坏
即使模型"想"生成对的字,渲染阶段也会出问题。AI绘画是基于扩散模型逐像素去噪,汉字的横平竖直在噪声中极易扭曲、粘连、缺笔。你看到的"缺胳膊少腿",其实是去噪过程中笔画被"模糊掉"了。
那怎么解决?
目前最靠谱的方案是分层处理:AI绘画负责背景和视觉,汉字用专业字体引擎单独渲染后叠加。或者使用针对汉字优化的模型(如部分国产大模型),在提示词中强制指定"标准简体字、无连笔、完整笔画"。
但坦白说,纯AI生成完美汉字,目前仍是行业难题。
AI能画出蒙娜丽莎,却写不好一个"人"字——技术的边界,往往藏在最基础的地方。
全部
来源
来源
内容由AI生成
1
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
已收藏
去我的收藏夹