文章
用游戏化搞AI安全,这家瑞士公司让全球用户一起“黑”它
AI安全公司Lakera另辟蹊径,把漏洞挖掘变成游戏,用众包模式拉起一支全球性的“AI红队”,每天产出海量攻防数据。靠着这种看似“玩”出来的方式,他们拿到了融资,并推出了企业级AI安全产品Lakera Guard。2025年,网络安全巨头Check Point收购了Lakera,进一步验证了AI安全赛道的价值。本文带你拆解这家瑞士公司的独特玩法。
AI安全,听起来是个挺严肃的话题。
但有一家公司,偏偏把这事儿玩出了“游戏感”。
他们拉了一大批人,每天不是写代码,而是变着花样“黑”AI模型——用提示注入、越狱攻击、数据投毒……各种手段,把大模型逼到极限。
更绝的是,他们把这些攻击行为变成了一个个有奖挑战,参与者像打游戏一样,一边破解漏洞,一边帮公司积累数据。
这支“众包”红队,每天能产生大量真实的攻防数据。
靠着这些数据,这家公司拿到了融资,并推出了自己的AI安全产品——Lakera Guard。
它就是瑞士初创公司Lakera。
AI火了,但安全漏洞也来了
咱们先聊聊背景。
现在几乎所有公司都在往AI上跑:用大模型搞知识库、做智能客服、优化业务流程……但很少有人停下来想一想——
当你的AI开始“胡说八道”,或者被恶意提示词引导,输出不该输出的内容时,怎么办?
提示注入、数据投毒、内容审核不力、隐私泄露……这些风险不是传统安全能解决的。
攻击者不用写代码,只要一段精心设计的文字,就能让AI说出不该说的话,甚至执行不该做的事。
Lakera正是看准了这个缺口。
他们的思路很直接:想防住攻击,先得知道攻击长什么样。
于是,他们建了一个庞大的AI威胁情报数据库,里面装着海量针对各种大模型的攻防数据。
但光靠内部团队收集,速度太慢。
他们想到了一个更聪明的方法——让全世界的人一起来“攻击”。
全球用户的“AI红队”,怎么玩的?
Lakera做了一个众包平台。
这可不是什么游戏,但它的玩法跟游戏差不多:
用户扮演“攻击者”,尝试用各种提示词骗过AI模型,获取隐藏的信息。
每成功一次,系统就记录下这次攻击的特征,并更新到安全数据库里。
这种方式,让普通人也能参与AI安全测试。
平台上积累了海量的攻击数据,每天新增大量新记录。
换句话说,Lakera相当于养了一支全球性的“AI红队”,一天24小时不停地在帮他们找漏洞。
这些数据,最终都喂给了他们自己的安全产品——
Lakera Guard:给你AI加上“防火墙”
Lakera Guard是一个面向企业的AI安全平台。
它能做什么?
- 防止提示注入:识别那些试图控制AI行为的恶意指令。
- 检测敏感数据泄露:避免AI输出中夹杂用户的隐私信息。
- 内容审核:过滤掉偏见、违规、不道德的内容。
- 幻觉问答:识别AI给出的不靠谱答案。
而且,Lakera Guard不挑模型。无论是GPT、Claude、Llama,还是国产大模型,都能接入。
开发者可以把它当成一个API调用,几行代码就能给AI应用加上安全层。
一个小众赛道,为什么能融到钱?
很多人觉得,AI安全是个“非刚需”。
但现实是,随着AI应用越来越深入,安全问题已经成了企业上线的最大拦路虎。
就在2025年,全球网络安全巨头Check Point收购了Lakera,将其技术整合到CloudGuard WAF中,专门为GenAI应用提供防护。
这说明,AI安全已经从“可选项”变成了“必选项”。
Lakera的独特之处在于,它用众包和游戏化的方式,让数据收集变得可持续、可规模化。
一支全球性的红队,每天海量新数据——这种动态更新的威胁情报库,是传统安全公司很难复制的。
从“玩”出来的安全,到行业的标配
Lakera的故事给我们的启发是:
AI安全,不能等出了问题再补救。
它需要像Lakera这样,主动出击,用海量数据训练出“懂语言”的防御系统。
而游戏化众包,恰好是让数据源源不断产生的最佳方式。
未来,随着AI Agent、大模型应用越来越多,像Lakera这样的安全公司,可能会成为每个AI团队的标配。
毕竟,AI跑得再快,也得先保证它不会跑偏。