OPC.run OPC.run 助跑超级个体

文章

用游戏化搞AI安全,这家瑞士公司让全球用户一起“黑”它

AI安全公司Lakera另辟蹊径,把漏洞挖掘变成游戏,用众包模式拉起一支全球性的“AI红队”,每天产出海量攻防数据。靠着这种看似“玩”出来的方式,他们拿到了融资,并推出了企业级AI安全产品Lakera Guard。2025年,网络安全巨头Check Point收购了Lakera,进一步验证了AI安全赛道的价值。本文带你拆解这家瑞士公司的独特玩法。

AI安全,听起来是个挺严肃的话题。

但有一家公司,偏偏把这事儿玩出了“游戏感”。

他们拉了一大批人,每天不是写代码,而是变着花样“黑”AI模型——用提示注入、越狱攻击、数据投毒……各种手段,把大模型逼到极限。

更绝的是,他们把这些攻击行为变成了一个个有奖挑战,参与者像打游戏一样,一边破解漏洞,一边帮公司积累数据。

这支“众包”红队,每天能产生大量真实的攻防数据。

靠着这些数据,这家公司拿到了融资,并推出了自己的AI安全产品——Lakera Guard。

它就是瑞士初创公司Lakera。


AI火了,但安全漏洞也来了

咱们先聊聊背景。

现在几乎所有公司都在往AI上跑:用大模型搞知识库、做智能客服、优化业务流程……但很少有人停下来想一想——

当你的AI开始“胡说八道”,或者被恶意提示词引导,输出不该输出的内容时,怎么办?

提示注入、数据投毒、内容审核不力、隐私泄露……这些风险不是传统安全能解决的。

攻击者不用写代码,只要一段精心设计的文字,就能让AI说出不该说的话,甚至执行不该做的事。

Lakera正是看准了这个缺口。

他们的思路很直接:想防住攻击,先得知道攻击长什么样。

于是,他们建了一个庞大的AI威胁情报数据库,里面装着海量针对各种大模型的攻防数据。

但光靠内部团队收集,速度太慢。

他们想到了一个更聪明的方法——让全世界的人一起来“攻击”。


全球用户的“AI红队”,怎么玩的?

Lakera做了一个众包平台。

这可不是什么游戏,但它的玩法跟游戏差不多:

用户扮演“攻击者”,尝试用各种提示词骗过AI模型,获取隐藏的信息。

每成功一次,系统就记录下这次攻击的特征,并更新到安全数据库里。

这种方式,让普通人也能参与AI安全测试。

平台上积累了海量的攻击数据,每天新增大量新记录。

换句话说,Lakera相当于养了一支全球性的“AI红队”,一天24小时不停地在帮他们找漏洞。

这些数据,最终都喂给了他们自己的安全产品——


Lakera Guard:给你AI加上“防火墙”

Lakera Guard是一个面向企业的AI安全平台。

它能做什么?

  • 防止提示注入:识别那些试图控制AI行为的恶意指令。
  • 检测敏感数据泄露:避免AI输出中夹杂用户的隐私信息。
  • 内容审核:过滤掉偏见、违规、不道德的内容。
  • 幻觉问答:识别AI给出的不靠谱答案。

而且,Lakera Guard不挑模型。无论是GPT、Claude、Llama,还是国产大模型,都能接入。

开发者可以把它当成一个API调用,几行代码就能给AI应用加上安全层。


一个小众赛道,为什么能融到钱?

很多人觉得,AI安全是个“非刚需”。

但现实是,随着AI应用越来越深入,安全问题已经成了企业上线的最大拦路虎。

就在2025年,全球网络安全巨头Check Point收购了Lakera,将其技术整合到CloudGuard WAF中,专门为GenAI应用提供防护。

这说明,AI安全已经从“可选项”变成了“必选项”。

Lakera的独特之处在于,它用众包和游戏化的方式,让数据收集变得可持续、可规模化。

一支全球性的红队,每天海量新数据——这种动态更新的威胁情报库,是传统安全公司很难复制的。


从“玩”出来的安全,到行业的标配

Lakera的故事给我们的启发是:

AI安全,不能等出了问题再补救。

它需要像Lakera这样,主动出击,用海量数据训练出“懂语言”的防御系统。

而游戏化众包,恰好是让数据源源不断产生的最佳方式。

未来,随着AI Agent、大模型应用越来越多,像Lakera这样的安全公司,可能会成为每个AI团队的标配。

毕竟,AI跑得再快,也得先保证它不会跑偏。