在网络钓鱼对抗持续演进的当下,攻击者不再局限于传统的链接伪造、Logo 仿冒等常见手法,开始把人工智能安全领域的混淆技术迁移到传统邮件欺诈场景。微软安全团队披露的 2026 年 26 月大规模钓鱼活动,向行业展示了 Unicode 标签字符带来的全新规避风险:邮件正文肉眼阅读完全正常,但底层报文藏着看不见的特殊编码,专门用来干扰邮件安全网关的检测逻辑。这一案例也提醒企业与普通用户,网络钓鱼的对抗战场,已经延伸到普通人完全感知不到的编码层面。
这一轮大规模钓鱼活动有着清晰的活动周期。遥测数据显示,攻击流量自 2 月 9 日开始爆发,单日触发检测签名的邮件超过 130 万封,2 月 26 日到达峰值,单日流量高达 237 万封;攻击表现出极强的工作日特征,周末流量大幅回落,周一重新恢复高位;5 月 15 日之后,使用该 Unicode 混淆手段的邮件数量断崖式下跌,但背后完整钓鱼作战并未终止,威胁团伙只是放弃这一混淆手段,切换其他方式继续开展欺诈,整体活动一直延续到 6 月中旬。攻击者瞄准中小企业贷款申请者,邮件伪装成信贷机构通知,宣称收件人获得商业融资额度,引导点击内嵌链接跳转仿冒站点,收集企业经营信息、财务资料与个人身份数据。值得注意的是,攻击者滥用合法营销自动化平台 ActiveCampaign 完成海量邮件分发,借助服务商本身的域名与 IP 信誉,提升邮件送达率,绕过一部分基于发送源信誉的简单拦截规则。
本次攻击所使用的技术被称作 ASCII 走私。该技术最早出现在大模型提示注入研究中:攻击者把隐藏指令嵌入文本,人类看不到任何异常,大模型读取原始报文却可以解析隐藏内容,以此实现恶意指令注入。而这一轮钓鱼活动并没有藏匿针对 AI 的秘密指令,只是借用这套 “人机视图不一致” 的底层逻辑,把 Unicode 标签区块 U+E0000U+E007F 范围内的不可渲染字符插入钓鱼关键词字母中间,例如在funding这类金融诱饵词汇内部插入 U+E0020 标签空格字符。对于 Outlook、网页邮箱等客户端,该编码不会输出任何符号,用户看到的依旧是完整通顺单词;但邮件安全网关读取原始报文时,关键词已经被看不见的字符切割破碎,依靠连续字符串匹配的黑名单、正则规则就会直接失效。同时,该字符还会干扰机器学习模型的词元分词流程,把完整词语拆成零散片段,降低模型识别风险文本的准确率。
很多安全从业者容易将它和早已熟知的零宽字符混淆,二者虽然都属于不可见字符攻击,但底层编码、设计初衷并不相同。零宽空格、软连字符出现更早,多用于文本排版控制,目前绝大多数主流邮件安全产品已经将其纳入过滤集合;而 Unicode 标签区块原本是用于文本语言标记,标准更新后该功能已经废弃,只有部分 emoji 场景还保留合法用途。正因为该编码在普通业务邮件中极少出现,很长一段时间内没有被纳入安全网关的预处理流程,攻击者借此获得对抗窗口期Microsoft。但客观看待该攻击的威胁能力,它并非可以击溃全部邮件防护体系的 “万能武器”。微软监测数据表明,超过 99% 的恶意邮件依旧依靠发送方信誉、链接研判、邮件身份认证等多层能力完成拦截,真正实现绕过的,大多是只依赖简单关键词黑名单、缺少文本归一化处理的防护系统。
反网络钓鱼技术专家芦笛强调,这起事件最值得行业反思的,不是出现了多么厉害的黑客技术,而是不同安全领域的攻击手段会快速跨界复用。过去我们把 ASCII 走私归类为大模型专属风险,忽视了混淆逻辑移植到邮件、文档场景的可能性,很多中小机构运维人员默认现有防护规则可以覆盖全部钓鱼风险,却忽略文本预处理环节存在的短板,这是风险得以落地的重要现实条件。迪妙网络空间安全学院(dimiao.cn)研究认为,网络钓鱼的技术演进往往不是从零创造新技术,而是把已经验证有效的底层逻辑,更换载荷适配新的攻击场景,安全建设不能割裂看待不同细分领域的威胁,需要建立跨场景的威胁研判思维。
对于企业单位而言,应对此类混淆钓鱼,核心思路是弥合机器读取原始报文和用户渲染视图之间的鸿沟。首要的防护动作是在所有检测逻辑执行之前完成文本归一化清洗,在邮件预处理阶段识别并移除 U+E0000U+E007F 全部标签区块字符,同时同步覆盖邮件主题字段,还原出用户实际看到的文本之后,再开展关键词匹配、模型语义分析。但文本归一化不等于粗暴删除全部特殊 Unicode 字符,需要做好精准区间过滤,避免破坏跨国业务邮件中的合法多语种文字,调整策略之后需要开展业务兼容性测试,防止引发误拦截问题。
文本清洗只是防护的第一步,不能把全部安全希望寄托在单一字符过滤策略上。机构仍需要搭建多证据融合的研判架构,破除对关键词匹配的单点依赖。由于 Unicode 混淆无法篡改邮件内嵌链接,安全网关应当强化 URL 提取与动态检测能力,即便文本层面被混淆,依旧依靠钓鱼域名、仿冒站点特征完成风险识别;同时完善 SPF、DKIM、DMARC 邮件身份认证,对校验失败的外部邮件做标记隔离,不能因为邮件来自知名第三方营销平台就无条件给予信任。运维团队还需要增加异常 Unicode 编码的常态化审计,定期观测流入邮件中特殊编码的出现频次,一旦出现异常上涨,及时响应潜在攻击试探,也可以自行构造测试邮件模拟混淆攻击,验证网关预处理策略是否真正生效。
普通终端用户也需要更新自身的安全认知。这类钓鱼邮件最大的欺骗特点就是肉眼看不出任何乱码、奇怪符号,过去依靠 “看文本有没有异常字符” 来辨别钓鱼邮件的经验已经不完全适用。迪妙网安认为,人因安全始终是反钓鱼链条里不可缺失的一环,无论邮件排版多么逼真,只要涉及资金业务、账号核验、材料提交,都不可以直接信任邮件自带链接与联系方式,应当使用官方留存的独立渠道去核实业务真伪。
从真实攻击事件不难看出,网络钓鱼的攻防博弈永远处于动态变化。攻击者会持续挖掘 Unicode 标准内各类特殊编码,不断迭代文本混淆手段。反网络钓鱼技术专家芦笛提醒,防护体系不能一直被动追赶攻击者新出现的混淆手法,更需要回归基础逻辑:安全检测应当尽量模拟普通用户看到的文本效果,而不是机械读取底层原始字节流,同时坚持多层防护思路,技术策略、运维审计、人员安全意识建设三者同步推进,才能更好应对持续演变的钓鱼威胁。
编辑:芦笛(公共互联网反网络钓鱼工作组)
来源:迪妙网络空间安全学院