前端 JS 经典:零宽字符

简介: 前端 JS 经典:零宽字符

1. 概念

看不见得字符,称为零宽字符,也叫幽灵字符。

2. 作用

保护我们文章得知识产权。加文字水印,不影响阅读。

3. unicode 零宽字符

U+200B: 空格符,用于较长单词得换行分隔。
U+200C: 断字符,用于阿拉伯文、德文、印度语系文字中,阻止连字效果。
U+FEFF: 非断空格符,用于阻断特定位置的换行分割。

4. 例子

以下两个字符串,在页面上,看着一样,其实并不相等。

let str = "abc";
let _str = "a\u200bb\u200bc";
 
console.log(str, _str); // abc a​b​c
console.log(str.length, _str.length); // 3 5
str == _str; // false


目录
相关文章
|
前端开发 JavaScript
前端JS控制网页复制粘贴
前端JS控制网页复制粘贴
|
存储 编解码 前端开发
前端 js 经典:字符编码详解
前端 js 经典:字符编码详解
567 0
|
Kubernetes 负载均衡 应用服务中间件
青云LB(负载均衡)与k8s实战(二)
青云LB结合Ingress实现访问k8s集群内部容器服务。
1252 0
|
5月前
|
机器学习/深度学习 人工智能 自然语言处理
tiktoken 对中文长文本的压缩率实证研究——基于百万 token 对话的三层量化框架验证
随着大模型长上下文能力的普及,tiktoken 及其他 BPE based 分词器已成为评估文本 token 数的标准工具。然而,其在中英文混合长文本中的实际压缩规律仍缺乏实证验证,业界普遍使用的经验公式(如中文字符 × 1.6)尚未在大规模语料上得到检验。本文基于 DeepSeek 百万 token项目中提纯后的对话数据(.jsonl,1 077 046 tokens,3 673 轮)采用反向推算方法,首次在真实中文长文本上量化了tiktoken 的压缩系数。主要发现: 1️⃣ 中文实际系数约为 1.16,远低于经验公式的 1.6,导致整体 token 估算高出20.9 %; 2️⃣ 对话呈
|
机器学习/深度学习 人工智能 自然语言处理
掌握从模型选型到部署优化的全流程
本文深入探讨了AI大模型的开发与应用,涵盖基础概念、模型架构、关键技术、训练方法、应用策略、评估优化及伦理安全七大核心内容。从人工智能的定义到深度学习、通用人工智能(AGI)的探索,再到Transformer架构、混合专家模型(MoE)等前沿技术,系统解析了构建智能系统的基石与工程效率的引擎。文章还介绍了提示工程、检索增强生成(RAG)、AI智能体等应用策略,强调了模型评估与优化的重要性,并探讨了AI伦理与安全的关键议题。适合希望全面了解AI大模型开发的技术人员与研究者参考。
756 0
|
缓存 移动开发 前端开发
【面试题】面试官问你前端性能优化时,他想问什么?
【面试题】面试官问你前端性能优化时,他想问什么?
490 0
|
缓存 NoSQL Java
SpringBoot中RedisCluster的scan命令实践
线上环境redis key过期一直很头疼,自动过期用户可能会给用户展示过期数据无法忍受,可是又无法掌握固定的key,redis给我们提供了高性能的scan操作,可千万不能用keys * 了! SpringBoot2.0升级使用lettuce替换了jedis为默认的reids连接工具。
3478 0
|
安全 开发工具 C++
Atom编辑器:曾经的效率提升利器,终将被新技术取代
Atom编辑器:曾经的效率提升利器,终将被新技术取代
685 0
|
API
在vite.config.js 配置代理
在vite.config.js 配置代理
2107 2

热门文章

最新文章