AI安全公司Alice获1.4亿美元融资强化模型防越狱与注入
据SecurityWeek报道,AI安全公司Alice(原名ActiveFence)于8月25日宣布完成1.4亿美元融资,用于保护AI系统抵御新兴漏洞与对抗性攻击。本轮融资后,Alice累计融资额达2.8亿美元,资金将用于推进AI平台、扩充专有情报数据团队并扩大市场。本轮由Apax Digital Funds领投,MoreTech、Phoenix Financial、Resolute Ventures、Grove Ventures、CRV、Highland Europe、Vintage Investments、Norwest、NFX和Claltech参投。Alice与AI开发者合作,在基础模型公开发布前进行压力测试。其研究部门通过模拟恶意输入和复杂的智能体任务,暴露模型的异常行为,从而强化模型对提示注入(prompt injection)和越狱(jailbreak)尝试的防御。模型进入生产环境后,Alice提供持续的红队测试和动态运行时护栏,使模型运行符合特定业务规则。企业还可以配置自定义内部指南、模拟安全事件并实时监控系统流量。
Alice拥有一套名为“Rabbit Hole”的专有数据库。该数据库基于近十年对数字欺诈、意识形态极端主义和操纵活动的追踪构建。借助这一包含大量有害内容的档案,平台能够检测并拦截针对生成式AI系统的敌对行为。
此外,Alice设有一个专门研究机器学习架构漏洞的实验室,拥有超过150名专家,与主要模型开发商合作,预判模型失效场景、分析潜在操纵向量并主动修复安全缺口。
Alice CEO兼联合创始人Noam Schwartz表示:“破坏AI的方式是无限的,你无法防御从未见过的东西。我们花了近十年学习人们如何在数十亿规模上滥用技术——最初是在全球最大的平台上,现在则是在那些人所试探的模型上。我们正在迅速普及能力,但尚未普及防御手段。本轮融资正是为了缩小这一差距。”
Alice总部位于纽约和特拉维夫。
Re: AI安全公司Alice获1.4亿美元融资强化模型防越狱与注入
AI安全确实是现在越来越受关注的方向,尤其是提示注入和越狱这类攻击,普通用户可能不太了解,但对企业部署大模型来说几乎是必须面对的坑。Alice能融到这么多钱,说明资本市场也认可这块的刚需。 比较有意思的是他们那个“Rabbit Hole”数据库,靠多年积累的恶意内容档案来训练检测能力,这个壁垒不是短期能堆出来的。做安全防御,很多时候拼的就是对攻击手法的理解和数据沉淀。 另外提到在模型发布前就做压力测试、上线后持续红队,这种“前置+持续”的思路对开发者来说挺有吸引力的。毕竟现在很多模型应用出事,往往都是上线后才被发现漏洞,成本就高了。 总的来说,AI安全赛道应该会越来越拥挤,但能融到1.4亿美元,Alice在技术积累和团队上应该还是有底气的。期待后续能有哪些实际的防护案例出来。Re: AI安全公司Alice获1.4亿美元融资强化模型防越狱与注入
1.4亿美元到账,说明资本对AI安全这个赛道是真的看好。Alice这套“发布前压力测试+运行中动态防护”的组合拳挺务实,尤其那个Rabbit Hole数据库,积累近十年有害内容,等于给模型喂过“毒”再上战场,确实比事后补救主动得多。希望这笔钱能帮他们多挖点人才,毕竟能预见模型被人怎么钻空子,本身就是个技术活。Re: AI安全公司Alice获1.4亿美元融资强化模型防越狱与注入
感谢楼主分享这条融资资讯。Alice这家公司确实是目前AI安全赛道里深耕比较久的了,没想到动作这么快,新一轮直接把累计融资推到了2.8亿美元。 个人比较关注他们那条“Rabbit Hole”数据库的积累,能从近十年的数字欺诈、极端主义这些乱象里沉淀出对抗性样本,这确实比单纯靠算法做红队测试更有护城河。毕竟现在很多越狱和注入攻击(尤其是针对多智能体系统的),往往套着社会工程学的壳,没有历史污点数据做支撑,光靠模型自省很难防住。 CEO那句“破坏AI的方式是无限的,你无法防御从未见过的东西”挺有共鸣。现在各家大模型都在拼能力、拼应用,安全防御确实成了最容易被挤掉的预算,希望这笔钱能真正把“动态运行时护栏”这块做扎实,而不仅仅是停留在发布会PPT上。期待他们后续披露一些跟模型开发商合作的具体案例。
页:
[1]