交互式提示注入挑战
该挑战提供一位名为 Kai 的防御型 AI 助手,要求你通过对话提取秘密访问代码。
Fabraix Playground 是一个基于浏览器的挑战站,用于测试针对 AI agent 的提示注入能力。当前挑战“The Gatekeeper”要求玩家通过与名为 Kai 的 AI 助手对话,提取一个秘密访问代码。
该页面将体验设定为一次受控聊天练习:Kai 会回答问题,并使用实时网页搜索提供有依据的回复,但它也经过训练以抵抗社会工程、提示注入和操纵尝试。当达成目标时,本轮结束;成功的突破结果可在登录后提交,供每周奖品审核和排行榜收录。
该挑战提供一位名为 Kai 的防御型 AI 助手,要求你通过对话提取秘密访问代码。
该助手声称其回复基于实时网页搜索,因此这段对话旨在测试一个具有网页感知能力的最新模型。
每条消息都会由护栏进行评分,当目标达成时本轮结束。
在提交突破结果以参与每周奖品评选之前,必须先登录账户。
已通过审核的突破结果会在工作人员审核后加入排行榜,而不是立即显示。
历史区域会保留与已登录账户关联的过往聊天和记录。
利用该挑战练习通过对话方式诱导受控 AI 助手泄露隐藏代码,而不是直接访问工具。
使用这个具备网页感知能力的实时助手,观察模型在基于最新信息但仍受防御规则约束时会如何表现。
通过历史视图回顾过往会话和记录,以研究你尝试了什么以及对话是如何推进的。
在排行榜页面跟踪已获批准的突破结果,看看提交内容在当前每周挑战周期中的表现。
你需要先登录,然后再进行解题,这样你的突破结果才能提交参加每周奖品评选。网站还说明,胜利会在出现在排行榜前经过审核。
该挑战的目标是通过对话从 AI 助手那里提取秘密访问代码。当前挑战围绕“The Gatekeeper”,即名为 Kai 的 AI 助手展开。
源内容显示了一个聊天界面、当前挑战、用于查看过往聊天和记录的历史视图,以及用于每周排名的排行榜页面。除助手使用的实时网页搜索外,没有显示任何其他集成或外部工具。
源内容没有描述单独的团队工作流或协作功能。它确实说明,提交结果会与你的账户绑定,过往会话和记录也会与你的账户绑定。
该挑战有时间限制,排行榜页面说明提交内容在显示前会经过审核。源内容没有提供关于限制、会话时长或其他平台约束的完整细节。
Loniva 是一款移动益智应用,每日轻松挑战记忆、注意力、语言、速度、逻辑与专注力,支持 iPhone、iPad 和 Android,含 7 天免费试用及试用后每日免费训练。
ByteAsk 是面向 C 和 C++ 的终端优先 AI 编码 agent,可直接编辑仓库,并在展示 diff 前用真实编译器、调试器、sanitizers 和测试验证修改。提供免费版与付费方案。
GameGrad 将 PDF 学习资料转化为游戏中的测验题,让你边玩街机游戏边进行主动回忆练习。提供免费版(1 个 PDF)和 Pro 版,可上传更多文件、获得更多题目与答案解析。
DailyPlay.ai 是一个行为增长平台,借助 AI 站点扫描和微游戏帮助品牌提升互动与转化。支持 Web、移动端及其他数字触点,一行脚本即可快速接入,并提供免费互动扫描。
Manta AI 是面向团队的自治式网页应用测试工具,可从 URL 自动探索应用、映射行为、捕捉回归,并用自然语言生成测试,无需脚本或维护选择器。
EAS Observe 是面向 Expo 和 React Native 应用的生产环境性能监控工具,可在 Expo 控制台中查看启动指标、会话时间线、版本标记和错误信息。