为了你的数据安全,不要将大模型当成网盘来用
最近几天,一些ChatGPT的老用户可能“有点烦”。因为OpenAI在7月底发布了一则公告,显示他们将于2026年8月30日关闭ChatGPT的DALL·E图像生成模型入口,并以新的ChatGPT Images取而代之。
为了你的数据安全,不要把大模型当网盘最关键的问题在于,随着DALL·E的关闭,所有过去用它生成的图像都将从服务器上被删除。因此OpenAI方面宣布,他们预留了一个月的缓冲期,如果用户不在这个时间内自行将过去创建的图像下载到本地,那么就将永远失去这些数据。
为什么会删除?因为新老模型之间“讲不通”
首先需要说明的一点是,OpenAI其实早在5月上旬就已经不再使用DALL·E这个模型,只是在ChatGPT中保留了它的数据访问入口。用户虽然不能再使用DALL·E生成图片,但此前依然可以查看过去生成的图片。
随着OpenAI宣布关闭入口并删除数据,实际上已经相当于给用户留了三个多月的时间,并不算是“仓促决定”。
为了你的数据安全,不要把大模型当网盘
DALL·E常见的“AI绘画”风格
但可能有人会有疑惑,OpenAI下线老模型上线新模型,难道就不能把用户过去的操作记录和图像数据直接迁移过去吗?
为了你的数据安全,不要把大模型当网盘
ChatGPT实际上很早就开始提醒用户,DALL·E已经“过时”
还真不能。这主要是因为DALL·E属于一种“外挂”模型。当用户过去在ChatGPT里调用DALL·E生成图片时,实际上是ChatGPT本身作为主模型先理解用户的意图,然后再将“需要画什么和怎么画”的提示词发给DALL·E。
也就是说,DALL·E从始至终压根不知道用户“为什么要画”,它只是被动接受ChatGPT“该画什么”的指令。在DALL·E存储的数据里,并不包含用户当时完整的创作需求上下文,而是只有ChatGPT主模型提炼过的提示词,以及最终根据这些提示词生成的图像。
为了你的数据安全,不要把大模型当网盘
可是新的ChatGPT Images模式并非外挂模型,而是原生多模态模型。也就是说它能自己理解用户的对话,并分析“该画什么”,然后据此进行创作,这就导致ChatGPT Images的数据格式、上下文逻辑与DALL·E完全不同。就算强行将老模型的数据迁移到新模型的服务器里,新模型也无法看懂这些没有上下文对话,仅有提示词的数据“到底在讲什么”,无法起到回溯用户过往对话和创作历史的作用。
因此直接删除老模型的历史数据,就成了OpenAI唯一的选择。
云端存储不保险,默认保存到本地不行吗?
如果大家平时有用过各种AI应用就会发现,这些应用里的对话、图像、音频等数据,在生成结束后都不会默认自动保存到设备本地。因此像OpenAI这样因为模型更新,或是旧模型下线而导致的数据丢失,其实并不鲜见。
那么为什么各厂商都不把数据默认保存到用户的本地设备上呢?其实这涉及到几个方面的原因。
为了你的数据安全,不要把大模型当网盘
首先,是不便于跨设备服务。众所周知,如今的大模型基本都能做到跨终端持续服务,比如在手机上进行的对话,可以在电脑或平板上继续查看、“接着问”。而这种跨设备能力的背后,最大的原因就是大模型会默认将上下文以及各种生成的数据,都持续保存在云端。如果大模型每次运行都只将数据保存到设备本地,那么用户每次“追问”或是跨设备使用时,就必须要先将之前的数据全部上传一遍,反而会显著增加等待时间。
其次,云端的数据保存模式也为大模型在不同性能设备上的“下放”,提供了可能。比如,现在一些功能机、算力低下的智能可穿戴设备,都能提供接入大模型的功能。可要是所有的数据都自动保存到本地,那么这些内置存储空间极为有限的设备,很快就会被“撑满”,反而可能造成使用的不便。
为了你的数据安全,不要把大模型当网盘而且默认云端存储的模式,也为大模型对话的合规管控打下了基础。毕竟如果数据只保存在用户的设备上,那么大模型服务商就很难第一时间发现违规内容。真要出了事,由于用户可能会修改、删除本地文件,保存在云端的原始对话记录也会成为辨别权责的依据。
最后,即便是对于“数据安全”这件事本身,云端存储可能也更有利于服务商撇清责任。毕竟数据默认保存在本地的话,万一用户自己“误操作”删除了数据却不愿承认,反而就很难说得清。相反,如今各AI服务商普遍采用的云端数据保存模式都有明确条款,平台仅提供“在线查看”服务,本就不承担永久保存的义务,如果用户真的很在乎历史数据,就应该自行保存。
大模型不能当网盘,数据安全还是得自己负责
其实站在OpenAI的角度来说,他们对于DALL·E的用户数据,已经留了足足三个多月的时间去给用户进行备份、导出。考虑到这段时间里,相关基础设施的存储容量是被已经无法产出利润的旧数据占据,甚至可以说OpenAI在这件事上做得“仁至义尽”,没什么毛病可挑。
但站在用户的角度来说,对话记录、创作历程,以及可能部分“作品”的丢失已成定局,他们当然也有理由觉得自己被当做了技术进步、业务更迭的牺牲品。
为了你的数据安全,不要把大模型当网盘所以这件事就告诉我们,尽管许多人已经将AI当做工作、学习的伙伴,甚至会倾诉日常生活中的烦心事,但AI技术在不断进步,现有的模型总有迎来迭代的那一天。也许到时候,历史对话数据会消失,你熟悉的对话风格也会“变了一个人”,所以如果真的很在乎自己的数据,那么不定期的备份就会非常有必要。
毕竟大模型不能当网盘用,AI厂商从来也没承诺过能陪你到“天长地久”。
【本文图片来自网络】
推荐阅读:怀念光盘游戏可以,但只靠嘴炮未免滑稽把游戏光盘做成收藏品,或许是好的结局。
优化入门级PC体验,微软不如做个Windows GO收购Tiny11,可能是如今微软最高效的一种方案。
