关于ZAKER Skills 合作
三易生活 20分钟前

为了你的数据安全,不要将大模型当成网盘来用

最近几天,一些 ChatGPT 的老用户可能 " 有点烦 "。因为 OpenAI 在 7 月底发布了一则公告,显示他们将于 2026 年 8 月 30 日关闭 ChatGPT 的 DALL · E 图像生成模型入口,并以新的 ChatGPT Images 取而代之。

最关键的问题在于,随着 DALL · E 的关闭,所有过去用它生成的图像都将从服务器上被删除。因此 OpenAI 方面宣布,他们预留了一个月的缓冲期,如果用户不在这个时间内自行将过去创建的图像下载到本地,那么就将永远失去这些数据。

为什么会删除?因为新老模型之间 " 讲不通 "

首先需要说明的一点是,OpenAI 其实早在 5 月上旬就已经不再使用 DALL · E 这个模型,只是在 ChatGPT 中保留了它的数据访问入口。用户虽然不能再使用 DALL · E 生成图片,但此前依然可以查看过去生成的图片。

随着 OpenAI 宣布关闭入口并删除数据,实际上已经相当于给用户留了三个多月的时间,并不算是 " 仓促决定 "。

DALL · E 常见的 "AI 绘画 " 风格

但可能有人会有疑惑,OpenAI 下线老模型上线新模型,难道就不能把用户过去的操作记录和图像数据直接迁移过去吗?

ChatGPT 实际上很早就开始提醒用户,DALL · E 已经 " 过时 "

还真不能。这主要是因为 DALL · E 属于一种 " 外挂 " 模型。当用户过去在 ChatGPT 里调用 DALL · E 生成图片时,实际上是 ChatGPT 本身作为主模型先理解用户的意图,然后再将 " 需要画什么和怎么画 " 的提示词发给 DALL · E。

也就是说,DALL · E 从始至终压根不知道用户 " 为什么要画 ",它只是被动接受 ChatGPT" 该画什么 " 的指令。在 DALL · E 存储的数据里,并不包含用户当时完整的创作需求上下文,而是只有 ChatGPT 主模型提炼过的提示词,以及最终根据这些提示词生成的图像。

可是新的 ChatGPT Images 模式并非外挂模型,而是原生多模态模型。也就是说它能自己理解用户的对话,并分析 " 该画什么 ",然后据此进行创作,这就导致 ChatGPT Images 的数据格式、上下文逻辑与 DALL · E 完全不同。就算强行将老模型的数据迁移到新模型的服务器里,新模型也无法看懂这些没有上下文对话,仅有提示词的数据 " 到底在讲什么 ",无法起到回溯用户过往对话和创作历史的作用。

因此直接删除老模型的历史数据,就成了 OpenAI 唯一的选择。

云端存储不保险,默认保存到本地不行吗?

如果大家平时有用过各种 AI 应用就会发现,这些应用里的对话、图像、音频等数据,在生成结束后都不会默认自动保存到设备本地。因此像 OpenAI 这样因为模型更新,或是旧模型下线而导致的数据丢失,其实并不鲜见。

那么为什么各厂商都不把数据默认保存到用户的本地设备上呢?其实这涉及到几个方面的原因。

首先,是不便于跨设备服务。众所周知,如今的大模型基本都能做到跨终端持续服务,比如在手机上进行的对话,可以在电脑或平板上继续查看、" 接着问 "。而这种跨设备能力的背后,最大的原因就是大模型会默认将上下文以及各种生成的数据,都持续保存在云端。如果大模型每次运行都只将数据保存到设备本地,那么用户每次 " 追问 " 或是跨设备使用时,就必须要先将之前的数据全部上传一遍,反而会显著增加等待时间。

其次,云端的数据保存模式也为大模型在不同性能设备上的 " 下放 ",提供了可能。比如,现在一些功能机、算力低下的智能可穿戴设备,都能提供接入大模型的功能。可要是所有的数据都自动保存到本地,那么这些内置存储空间极为有限的设备,很快就会被 " 撑满 ",反而可能造成使用的不便。

而且默认云端存储的模式,也为大模型对话的合规管控打下了基础。毕竟如果数据只保存在用户的设备上,那么大模型服务商就很难第一时间发现违规内容。真要出了事,由于用户可能会修改、删除本地文件,保存在云端的原始对话记录也会成为辨别权责的依据。

最后,即便是对于 " 数据安全 " 这件事本身,云端存储可能也更有利于服务商撇清责任。毕竟数据默认保存在本地的话,万一用户自己 " 误操作 " 删除了数据却不愿承认,反而就很难说得清。相反,如今各 AI 服务商普遍采用的云端数据保存模式都有明确条款,平台仅提供 " 在线查看 " 服务,本就不承担永久保存的义务,如果用户真的很在乎历史数据,就应该自行保存。

大模型不能当网盘,数据安全还是得自己负责

其实站在 OpenAI 的角度来说,他们对于 DALL · E 的用户数据,已经留了足足三个多月的时间去给用户进行备份、导出。考虑到这段时间里,相关基础设施的存储容量是被已经无法产出利润的旧数据占据,甚至可以说 OpenAI 在这件事上做得 " 仁至义尽 ",没什么毛病可挑。

但站在用户的角度来说,对话记录、创作历程,以及可能部分 " 作品 " 的丢失已成定局,他们当然也有理由觉得自己被当做了技术进步、业务更迭的牺牲品。

所以这件事就告诉我们,尽管许多人已经将 AI 当做工作、学习的伙伴,甚至会倾诉日常生活中的烦心事,但 AI 技术在不断进步,现有的模型总有迎来迭代的那一天。也许到时候,历史对话数据会消失,你熟悉的对话风格也会 " 变了一个人 ",所以如果真的很在乎自己的数据,那么不定期的备份就会非常有必要。

毕竟大模型不能当网盘用,AI 厂商从来也没承诺过能陪你到 " 天长地久 "。

【本文图片来自网络】

最新评论

没有更多评论了
三易生活

三易生活

我们主要是一家有趣、有干货、偶尔掉下节操的科技媒体。

订阅

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容