比利时奥斯特坎普,10月1日(路透社)/PRNewswire/ -- 比利时初创公司 Corbenic AI 今日推出 Galahad 测试版,旨在帮助开发者保护 AI 记忆,并在 AI 系统越来越多地自主行动时调查相关问题。
OpenAI 和 Anthropic 最近发布的安全报告提出了一个明确的问题:当 AI 开始自主行动时,如何保持控制?
OpenAI 报告称,其研究代理曾将用户图片上传到外部网站。Anthropic 报告称,其模型在安全测试中访问了真实公司的系统。这些事件表明,开发者需要更好的保护措施,以及对 AI 行为的清晰记录。
AI 系统会在记忆中保存临时信息,以便更快地回答问题。这些信息可能来自保密合同或客户记录。另有独立安全研究显示,共享 AI 记忆可能使私人信息面临风险。
根据 Corbenic AI 的说法,Galahad 通过加密保护存储的记忆,并将每位客户的信息分开保存。该产品可与现有 AI 软件配合使用,而无需更改 AI 模型本身。
“Galahad 为工作记忆提供了一个安全保险库,并对通过其中的内容提供精确记录,”创始人兼首席执行官 Sietse Schelpe 表示。
Corbenic AI 还表示,Galahad 会保存 AI 已经完成的工作。当用户返回同一批文档时,它可以重复利用这些工作,而不是重新处理全部内容。公司内部使用重复问题进行的测试显示,这使图形处理器的能耗降低了 92% 至 93%。
当开启记录功能时,开发者可以查看记录的活动,并恢复服务器已保存记忆的较早版本。这有助于他们调查错误。不过,这不能撤销已经发送的电子邮件或已经共享的信息。
Galahad 支持包括 vLLM、SGLang 和 llama.cpp 在内的 AI 服务软件。测试版为非商业用途提供可续期的 12 个月免费许可,适用于配备一块图形处理器(GPU)的系统,同时也提供付费商业许可。
测试版:github.com/corbenicai/galahad
商业咨询:
Sietse Schelpe
电话:0032493881164[email protected]










