chapter_data_structure/character_encoding/ #66
Replies: 40 comments 33 replies
|
大佬!Fig. UTF-8 编码示例 图中的UTF-8 h和e是不是写反了? |
|
在3.4.5中,为什么说 UTF-16是等长编码呢,它不是使用2个或者4个字符来表示字符吗~ |
|
这样说来,python3是处理字符串最高效的? |
|
说到字符编码,我最痛恨的就是关系型数据库的字符串类型,还需要不停的设置长度,这么多年了,依旧如此! |
|
懂了 |
|
感觉还是没太明白为什么 |
|
提个建议,图片可以加个点击预览放大的功能,有的图内容要素过多,放大预览效果可能更好 |
|
我听不懂该怎末办 |
|
上面关于Python 3 的内容貌似有误。借助GPT做了试验: ===== 以下是一些超出BMP范围的汉字示例: 𨊻(U+2A2BB,属于补充平面) 创建一个 Unicode 字符串 mystr = "你好,>𨊻𨋾<!"导入 chardet 模块查看字符串编码 import chardet使用 chardet 模块检测字符串的编码 result = chardet.detect(str)打印字符串的编码 print(result['encoding'])输出:utf-8 在 Python 3 中,所有字符串都是 Unicode 字符串,默认编码是 UTF-8。 以上是Bart的输出结果,可再查证确认。 |
|
那c++是用什么编码呢,顺便想问一下现在用c++的人很少了吗,因为现在不知道主学什么语言😢 |
|
一直被这些编码困惑,零星地搜索材料也是一知半解,没想到作者这么系统又简洁地解释!这种风格让我联想起了Golang的风格 |
|
一直有个疑问,为什么vscode使用utf-8编码写c/cpp的代码中出现中文就会乱码,但是用gbk编码就不会 |
|
最常见的莫过于 |
|
建议搞个pwa,可以安装到桌面 |
|
😁很棒!!! |
|
文中提到的“代理对”是什么呀?🤔 |
|
编码这一篇写的很清晰,大有收获😋 |
|
为什么 UTF-8表示中文用3个字节,UTF-16只用2个字节。既然2个字节够用,为什么要用三个字节? |
|
这一章讲得太清楚了,真很值得一看 |
|
the best articles of coding |
|
他奶奶的孙子的!好乱!脑子疼要长脑子了! |
|
之前也查过相关的知识,看的云里雾里,看着这篇文章突然的就懂了。 |
|
示例解析(以汉字“算”的Unicode码点U+7B97为例): |
|
utf-16中如何判断四字节是由两个2字节组成的还是仅仅就是一个4字节的字符? |
|
讲得很棒,感谢分享 |
|
厉害 |
unicode 是字符与码点的映射,码点是个纯数字概念,不存在某个字符占用多少字节的说法。比如,某个字符的码点为 1,那么这个 1 仅仅只是数字 1,自然数 0 的后继;用几个字节表示、用中文还是英文表示,用什么进制表示,都与其本质无关。 相应的,utf-8 等才是编码方案,才可以说在这个编码下某个字符占用多少字节。 |
|
难 |
|
Unicode = 字符集(定义字符与码点),UTF‑8 = 编码(定义码点如何转成字节); 以前根们就没有字符集和编码的概念... |
|
这个unicode是字符集 和码点一一对应, 通常16进制只时便于展示; |
Uh oh!
There was an error while loading. Please reload this page.
Uh oh!
There was an error while loading. Please reload this page.
chapter_data_structure/character_encoding/
一本动画图解、能运行、可提问的数据结构与算法入门书
https://www.hello-algo.com/chapter_data_structure/character_encoding/
All reactions