一款网络安全研究游戏,用于测量人类如何检测AI生成的钓鱼邮件。以复古终端体验构建。
在线体验: research.scottaltiparmak.com
AI现在能够生成语法完美、拼写无误且语境令人信服的钓鱼邮件。旧的信号(语法错误、措辞别扭、明显拼写错误)已不再适用。那么,在2026年,人类如何检测钓鱼攻击呢?
威胁终端是一款游戏及实时研究平台。玩家在复古终端界面中阅读AI生成的邮件,判断每封邮件是钓鱼邮件还是合法邮件,并押注自己的信心。每一次回答都会贡献给一个实时数据集,用于衡量当语言质量不再可靠时,人类最容易漏掉哪些钓鱼技术。
无需安全背景。只要您使用电子邮件,您就是一名有效的研究参与者。
| 模式 | 描述 | 访问权限 |
|---|---|---|
| 研究模式 | 每轮从研究数据集中获得10张卡片。每位玩家为研究贡献恰好30个答案,然后毕业并解锁其他模式。 | 需要登录 |
| 自由模式 | 每轮10张随机卡片,可无限重玩。 | 研究毕业后解锁 |
| 每日挑战 | 所有玩家每天相同的10张卡片。UTC午夜重置。每天一次尝试。 | 研究毕业后解锁 |
| 专家模式 | 极高难度,双倍经验。 | 研究毕业后解锁 |
| H2H排位 | 一对一PvP,每场5张卡片,双方相同牌组。7级排位系统(青铜→精英)。AI机器人作为后备对手。 | 研究毕业后解锁 |
| DEADLOCK | 类Roguelike生存模式,5层难度递增的关卡,带有永久死亡、楼层机制、卡片修饰、技能商店和永久升级。 | 研究毕业后解锁 |
核心循环:
游戏过程中的取证信号:
一个类Roguelike生存挑战,通过5层难度递增的关卡(简单→极限)。每层5张卡片,3条生命,永久死亡。
楼层机制为每层增添修饰:
卡片修饰使单张卡片更难:LOOKALIKE_DOMAIN, DECOY_RED_FLAGS, AI_ENHANCED, TIMED, REDACTED_SENDER
情报经济: 从正确答案、连击和通关楼层中获得情报点数。在楼层之间的技能商店消耗情报,可购买如EXTRA_LIFE, SHIELD, DOUBLE_INTEL, SLOW_TIME, STREAK_SAVER, INTEL_CACHE等物品。技能协同可解锁组合效果。
永久升级: 在多次游戏过程中获得安全许可,解锁横跨3大分支的12项永久升级:
助手伙伴: SIGINT,一名AI助手,在整个游戏过程中提供情境对话——对连击、险胜、通关楼层和失败做出反应。
与其他玩家或AI机器人进行竞争性一对一比赛。
30多个成就徽章,横跨9个类别,7种稀有度等级(普通→独特):
| 类别 | 示例 |
|---|---|
| 进度 | FIRST_BLOOD, VETERAN_ANALYST, RESEARCH_GRADUATE, APEX_OPERATOR |
| 技能 | ZERO_MISS, DEAD_CERTAIN, HARD_TARGET, EXPERT_ACE |
| 连击 | HOT_STREAK, UNTOUCHABLE, DAILY_OPERATOR |
| 速度 | SPEED_DEMON, METHODICAL |
| 调查 | HEADER_HUNTER, URL_INSPECTOR, FULL_RECON |
| 经验 | KILOBYTE, ENCRYPTED, CLASSIFIED, HIGH_SCORE |
| H2H | FIRST_KILL, SERIAL_WINNER, APEX_PREDATOR, FLAWLESS_VICTORY |
| DEADLOCK | FIRST_BREACH, TOWER_CLEAR, FLAWLESS_OP, GLASS_CANNON, SURVIVOR |
| 第0赛季 | FOUNDER, S0_SILVER, S0_GOLD, S0_DIAMOND, S0_ELITE |
成就可在物品页面浏览,支持稀有度过滤和统计追踪。
研究问题: 当语言质量不再是可靠的检测信号时,人类最有可能漏掉哪些钓鱼技术?
数据集: 1000多张AI生成的邮件卡片。钓鱼卡片涵盖6种技术,合法卡片涵盖交易、营销和工作场所类别。所有卡片均为AI生成,因此语言质量保持不变。技术是自变量。
正在研究的六种钓鱼技术:
urgency · authority-impersonation · credential-harvest · hyper-personalization · pretexting · fluent-prose
数据收集: 研究模式需要玩家账户。答案与伪匿名玩家UUID关联。电子邮件地址仅保存在Supabase Auth中,绝不会存储在研究表中。游戏会话外无行为跟踪。
每次回答记录: 分类、信心等级、响应时间、是否打开邮件头、是否检查URL、会话中的位置、卡片难度和技术。
未记录: 电子邮件地址、IP地址、位置或任何身份识别信息。
玩家可自愿报告其专业背景:NON-TECHNICAL、TECHNICAL / NON-SECURITY 或 INFOSEC / CYBERSECURITY。这使我们可以比较不同专业水平下的绕过率。
情报简报: 研究毕业后,玩家解锁情报简报——一个实时仪表板,显示所有参与者的汇总发现,包括总体绕过率、按背景划分的准确性以及技术有效性。
| 层 | 技术 |
|---|---|
| 前端 | Next.js 16(App Router),React 19,TypeScript,Tailwind CSS v4 |
| 认证 | Supabase Auth(邮件OTP,无密码) |
| 数据库 | Supabase(PostgreSQL) |
| 缓存/速率限制 | Upstash Redis |
| 托管 | Vercel |
| 邮件 | Resend(通过 scottaltiparmak.com 的 SMTP) |
| 卡片生成 | Claude(Anthropic API) |
| 音频 | Tone.js(合成音效) |
| 分析 | Vercel Analytics |
| 测试 | Playwright(E2E) |
| PWA | 服务工作者,自动更新,可安装于移动设备 |
| 卡池 | 卡片数 | 难度 | 用于 |
|---|---|---|---|
| 每日/自由 | 450+ | 简单,中等,困难 | 每日挑战,自由模式 |
| 专家 | 180+ | 极限 | 专家模式 |
| 研究 | 1000+ | 简单→极限 | 研究模式(冻结数据集) |
每个卡池独立。研究卡片不会在其他游戏模式中重复使用。DEADLOCK 和 H2H 从每日/自由和专家池中抽取。
MIT