据彭博援引知情人士报道,SpaceX 旗下 AI 部门曾在内部非正式讨论,考虑收购已倒闭初创公司留下的客户资料和运营记录,用于训练 Grok。相关设想目前仍停留在讨论阶段,未必会推进,但这反映出 AI 公司正把目光转向更难获取、也更具商业价值的数据源。
目标是获取真实业务数据
这类数据不同于公开网页抓取内容,更接近企业日常经营中形成的邮件、内部协作记录、客户信息和流程文档。对训练模型而言,这些材料能提供更完整的业务场景,因此价值正在上升。
报道提到,SpaceXAI 成立于今年 2 月,源于 SpaceX 与 xAI 的整合。其内部讨论的方向,不是向仍在运营的公司购买授权数据,而是关注已经破产或停止运营的企业遗留数据资产。由于原公司已不存在,这类数据往往会在破产清算中与其他资产一同出售。
类似做法已有先例
谷歌此前已在破产拍卖中采取过类似动作。报道指出,谷歌曾以 1000 万美元竞得 Spirit Airlines 的内部业务记录。这批资料包括大量邮件、微软 Teams 消息以及员工档案,并被纳入 AI 训练流程。
不过,这类交易也引发了隐私和数据使用边界的争议。Spirit Airlines 相关员工工会曾在破产法庭提出反对,认为即便数据经过“去标识化”处理,长期内部沟通记录仍可能被重新拼接并识别出具体个人。相关司法争议目前仍未结束。
从破产处置流程看,客户数据库和办公设备一样,通常都可被视为可出售资产,用于偿还债务。问题在于,数据涉及的客户和员工往往并不会直接参与这类出售决定。
马斯克还要求挖掘内部记录
除外部数据外,马斯克也在推动使用 SpaceX 自身的内部资料训练模型。报道称,今年 8 月的一次全员会议上,他告诉员工,Grok 将使用 SpaceX 几乎全部内部记录进行训练,并称该模型会“继承”员工的想法和工作方式。
报道还称,马斯克将这一做法描述为模型成长的一部分,希望员工把自己视为在“培养”模型。不过,哪些员工数据会被纳入训练、具体如何使用,目前并无更明确的公开说明。
Grok 4.5 已于 7 月发布,这是 xAI 完成整合后的首个模型版本。随着模型迭代继续推进,训练数据的来源、使用范围以及员工和客户信息如何处理,可能会成为外界继续关注的焦点。










