主頁 > .NET開發 > 判斷字符寬度

判斷字符寬度

2022-04-22 06:11:36 .NET開發

之前曾在《C# 中容易忽視的 Encoding.GetByteCount 記憶體問題》中提到過,可以使用 Encoding.Default.GetByteCount 方法來判斷字符是全寬(寬度為 2)還是半寬(寬度為 1),

這個方法實際上是計算對字符編碼后產生的位元組數,只是在中文環境下,寬字符在使用默認編碼后一般都會占用兩個位元組,使得在大多數場景下都沒有什么問題,但根據 Unicode 標準,EAST ASIAN WIDTH 才是準確的字符寬度定義,適用于東亞文本的字符的寬度計算,

標準中定義了六類字符寬度:

  • 全角Fullwidth):在 Unicode 標準中定義的全角字符,例如“0123, ABCD”等,
  • 半角Halfwidth):在 Unicode 標準中定義的半角字符,例如“?????”等,
  • Width):始終為寬的其它字符,一般僅在東亞背景關系中出現,例如中文字符,
  • Narrow):始終窄的的其它字符,它們一般都有對應的全角或寬字符,例如“0123, ABCD”等,
  • 不明確Ambiguous):根據不同情況可能顯示不同寬窄的字符,
  • 中性Neutral):其它所有字符,一般不用于東亞文本,

標準建議,寬字符包括 W、F 和 A(在東亞背景關系中),窄字符包括 N、Na、H 和 A(非東亞背景關系中),下圖是一個決議寬度的示例,

字符類別及其決議寬度的示例

圖 1 字符類別及其決議寬度的示例,圖片來自 http://www.unicode.org/reports/tr11/

但在實際測驗時發現,A 類別的處理要復雜很多,并非所有 A 類別字符都會顯示為寬(或窄),而且不同字體也會有不同的處理方式,

\u00A1\u00A4\u00A7\u01CE\u22BF\u2312 這六個字符為例,它們均為 A 類別,但在 Consolas 字體下,前四個字符顯示為窄,后兩個字符顯示為寬;在新宋體下,第一和第四個字符顯示為窄,其它字符顯示為寬,

不同字體顯示不一致

圖 2 不同字體顯示不一致

由于這種場景實在過于復雜,因此目前將 A 類別統一當作窄字符來計算,在用到這類字符的場景下再單獨考慮,

將 Unicode 13.0.0 下的 EAST ASIAN WIDTH 統一掃描后,整理得到以下寬字符范圍:

# 1100 ~ 115F Hangul Jamo
1100..115F
# User interface symbols
231A..231B
2329..232A
23E9..23EC
23F0..23F0
23F3..23F3
25FD..25FE
2614..2615
2648..2653
267F..267F
2693..2693
26A1..26A1
26AA..26AB
26BD..26BE
26C4..26C5
26CE..26CE
26D4..26D4
26EA..26EA
26F2..26F3
26F5..26F5
26FA..26FA
26FD..26FD
2705..2705
270A..270B
2728..2728
274C..274C
274E..274E
2753..2755
2757..2757
2795..2797
27B0..27B0
27BF..27BF
2B1B..2B1C
2B50..2B50
2B55..2B55
# 2E80 ~ 2EFF CJK Radicals Supplement
# 2F00 ~ 2FDF Kangxi Radicals
# 2FF0 ~ 2FFF Ideographic Description Characters
# 3000 ~ 303E CJK Symbols and Punctuation
2E80..303E
# 3040 ~ 309F Hiragana
# 30A0 ~ 30FF Katakana
# 3100 ~ 312F Bopomofo
# 3030 ~ 318F Hangul Compatibility Jamo
# 3190 ~ 319F Kanbun
# 31A0 ~ 31BF Bopomofo Extended
# 31C0 ~ 31EF CJK Strokes
# 31F0 ~ 31FF Katakana Phonetic Extensions
# 3200 ~ 32FF Enclosed CJK Letters and Months
# 3300 ~ 33FF CJK Compatibility
# 3400 ~ 4DBF CJK Unified Ideographs Extension A
3040..4DBF
# 4E00 ~ 9FFC CJK Unified Ideographs
# A000 ~ A48F Yi Syllables
# A490 ~ A4CF Yi Radicals
4E00..A4CF
# A960 ~ A97F Hangul Jamo Extended-A
A960..A97F
# AC00 ~ D7A3 Hangul Syllables
AC00..D7A3
# F900 ~ FAFF CJK Compatibility Ideographs
F900..FAFF
# FE10 ~ FE19 Vertical forms
FE10..FE19
# FE30 ~ FE4F CJK Compatibility Forms
# FE50 ~ FE6F Small Form Variants
FE30..FE6F
# FF00 ~ FF60 Fullwidth ASCII variants
FF01..FF60
# FFE0 ~ FFE6 Fullwidth symbol variants
FFE0..FFE6

具體實作可以參見 https://github.com/CYJB/Cyjb/blob/master/Cyjb/CharUtil.cs,

作者:CYJB
出處:http://www.cnblogs.com/cyjb/
GitHub:https://github.com/CYJB/
本文著作權歸作者和博客園共有,歡迎轉載,但未經作者同意必須保留此段宣告,且在文章頁面明顯位置給出原文連接,否則保留追究法律責任的權利,

轉載請註明出處,本文鏈接:https://www.uj5u.com/net/460716.html

標籤:C#

上一篇:ROZRZ在線測量自動測量在線刀補CNC遠程刀補機床遠程刀聯對刀儀遠程刀補掃碼傳輸刀補

下一篇:ASP.NET Core實作JWT授權與認證(1.理論篇)

標籤雲
其他(157675) Python(38076) JavaScript(25376) Java(17977) C(15215) 區塊鏈(8255) C#(7972) AI(7469) 爪哇(7425) MySQL(7132) html(6777) 基礎類(6313) sql(6102) 熊猫(6058) PHP(5869) 数组(5741) R(5409) Linux(5327) 反应(5209) 腳本語言(PerlPython)(5129) 非技術區(4971) Android(4554) 数据框(4311) css(4259) 节点.js(4032) C語言(3288) json(3245) 列表(3129) 扑(3119) C++語言(3117) 安卓(2998) 打字稿(2995) VBA(2789) Java相關(2746) 疑難問題(2699) 细绳(2522) 單片機工控(2479) iOS(2429) ASP.NET(2402) MongoDB(2323) 麻木的(2285) 正则表达式(2254) 字典(2211) 循环(2198) 迅速(2185) 擅长(2169) 镖(2155) 功能(1967) .NET技术(1958) Web開發(1951) python-3.x(1918) HtmlCss(1915) 弹簧靴(1913) C++(1909) xml(1889) PostgreSQL(1872) .NETCore(1853) 谷歌表格(1846) Unity3D(1843) for循环(1842)

熱門瀏覽
  • WebAPI簡介

    Web體系結構: 有三個核心:資源(resource),URL(統一資源識別符號)和表示 他們的關系是這樣的:一個資源由一個URL進行標識,HTTP客戶端使用URL定位資源,表示是從資源回傳資料,媒體型別是資源回傳的資料格式。 接下來我們說下HTTP. HTTP協議的系統是一種無狀態的方式,使用請求/ ......

    uj5u.com 2020-09-09 22:07:47 more
  • asp.net core 3.1 入口:Program.cs中的Main函式

    本文分析Program.cs 中Main()函式中代碼的運行順序分析asp.net core程式的啟動,重點不是剖析原始碼,而是理清程式開始時執行的順序。到呼叫了哪些實體,哪些法方。asp.net core 3.1 的程式入口在專案Program.cs檔案里,如下。ususing System; us ......

    uj5u.com 2020-09-09 22:07:49 more
  • asp.net網站作為websocket服務端的應用該如何寫

    最近被websocket的一個問題困擾了很久,有一個需求是在web網站中搭建websocket服務。客戶端通過網頁與服務器建立連接,然后服務器根據ip給客戶端網頁發送資訊。 其實,這個需求并不難,只是剛開始對websocket的內容不太了解。上網搜索了一下,有通過asp.net core 實作的、有 ......

    uj5u.com 2020-09-09 22:08:02 more
  • ASP.NET 開源匯入匯出庫Magicodes.IE Docker中使用

    Magicodes.IE在Docker中使用 更新歷史 2019.02.13 【Nuget】版本更新到2.0.2 【匯入】修復單列匯入的Bug,單元測驗“OneColumnImporter_Test”。問題見(https://github.com/dotnetcore/Magicodes.IE/is ......

    uj5u.com 2020-09-09 22:08:05 more
  • 在webform中使用ajax

    如果你用過Asp.net webform, 說明你也算是.NET 開發的老兵了。WEBform應該是2011 2013左右,當時還用visual studio 2005、 visual studio 2008。后來基本都用的是MVC。 如果是新開發的專案,估計沒人會用webform技術。但是有些舊版 ......

    uj5u.com 2020-09-09 22:08:50 more
  • iis添加asp.net網站,訪問提示:由于擴展配置問題而無法提供您請求的

    今天在iis服務器配置asp.net網站,遇到一個問題,記錄一下: 問題:由于擴展配置問題而無法提供您請求的頁面。如果該頁面是腳本,請添加處理程式。如果應下載檔案,請添加 MIME 映射。 WindowServer2012服務器,添加角色安裝完.netframework和iis之后,運行aspx頁面 ......

    uj5u.com 2020-09-09 22:10:00 more
  • WebAPI-處理架構

    帶著問題去思考,大家好! 問題1:HTTP請求和回傳相應的HTTP回應資訊之間發生了什么? 1:首先是最底層,托管層,位于WebAPI和底層HTTP堆疊之間 2:其次是 訊息處理程式管道層,這里比如日志和快取。OWIN的參考是將訊息處理程式管道的一些功能下移到堆疊下端的OWIN中間件了。 3:控制器處理 ......

    uj5u.com 2020-09-09 22:11:13 more
  • 微信門戶開發框架-使用指導說明書

    微信門戶應用管理系統,采用基于 MVC + Bootstrap + Ajax + Enterprise Library的技術路線,界面層采用Boostrap + Metronic組合的前端框架,資料訪問層支持Oracle、SQLServer、MySQL、PostgreSQL等資料庫。框架以MVC5,... ......

    uj5u.com 2020-09-09 22:15:18 more
  • WebAPI-HTTP編程模型

    帶著問題去思考,大家好!它是什么?它包含什么?它能干什么? 訊息 HTTP編程模型的核心就是訊息抽象,表示為:HttPRequestMessage,HttpResponseMessage.用于客戶端和服務端之間交換請求和回應訊息。 HttpMethod類包含了一組靜態屬性: private stat ......

    uj5u.com 2020-09-09 22:15:23 more
  • 部署WebApi隨筆

    一、跨域 NuGet參考Microsoft.AspNet.WebApi.Cors WebApiConfig.cs中配置: // Web API 配置和服務 config.EnableCors(new EnableCorsAttribute("*", "*", "*")); 二、清除默認回傳XML格式 ......

    uj5u.com 2020-09-09 22:15:48 more
最新发布
  • C#多執行緒學習(二) 如何操縱一個執行緒

    <a href="https://www.cnblogs.com/x-zhi/" target="_blank"><img width="48" height="48" class="pfs" src="https://pic.cnblogs.com/face/2943582/20220801082530.png" alt="" /></...

    uj5u.com 2023-04-19 09:17:20 more
  • C#多執行緒學習(二) 如何操縱一個執行緒

    C#多執行緒學習(二) 如何操縱一個執行緒 執行緒學習第一篇:C#多執行緒學習(一) 多執行緒的相關概念 下面我們就動手來創建一個執行緒,使用Thread類創建執行緒時,只需提供執行緒入口即可。(執行緒入口使程式知道該讓這個執行緒干什么事) 在C#中,執行緒入口是通過ThreadStart代理(delegate)來提供的 ......

    uj5u.com 2023-04-19 09:16:49 more
  • 記一次 .NET某醫療器械清洗系統 卡死分析

    <a href="https://www.cnblogs.com/huangxincheng/" target="_blank"><img width="48" height="48" class="pfs" src="https://pic.cnblogs.com/face/214741/20200614104537.png" alt="" /&g...

    uj5u.com 2023-04-18 08:39:04 more
  • 記一次 .NET某醫療器械清洗系統 卡死分析

    一:背景 1. 講故事 前段時間協助訓練營里的一位朋友分析了一個程式卡死的問題,回過頭來看這個案例比較經典,這篇稍微整理一下供后來者少踩坑吧。 二:WinDbg 分析 1. 為什么會卡死 因為是表單程式,理所當然就是看主執行緒此時正在做什么? 可以用 ~0s ; k 看一下便知。 0:000> k # ......

    uj5u.com 2023-04-18 08:33:10 more
  • SignalR, No Connection with that ID,IIS

    <a href="https://www.cnblogs.com/smartstar/" target="_blank"><img width="48" height="48" class="pfs" src="https://pic.cnblogs.com/face/u36196.jpg" alt="" /></a>...

    uj5u.com 2023-03-30 17:21:52 more
  • 一次對pool的誤用導致的.net頻繁gc的診斷分析

    <a href="https://www.cnblogs.com/dotnet-diagnostic/" target="_blank"><img width="48" height="48" class="pfs" src="https://pic.cnblogs.com/face/3115652/20230225090434.png" alt=""...

    uj5u.com 2023-03-28 10:15:33 more
  • 一次對pool的誤用導致的.net頻繁gc的診斷分析

    <a href="https://www.cnblogs.com/dotnet-diagnostic/" target="_blank"><img width="48" height="48" class="pfs" src="https://pic.cnblogs.com/face/3115652/20230225090434.png" alt=""...

    uj5u.com 2023-03-28 10:13:31 more
  • C#遍歷指定檔案夾中所有檔案的3種方法

    <a href="https://www.cnblogs.com/xbhp/" target="_blank"><img width="48" height="48" class="pfs" src="https://pic.cnblogs.com/face/957602/20230310105611.png" alt="" /></a&...

    uj5u.com 2023-03-27 14:46:55 more
  • C#/VB.NET:如何將PDF轉為PDF/A

    <a href="https://www.cnblogs.com/Carina-baby/" target="_blank"><img width="48" height="48" class="pfs" src="https://pic.cnblogs.com/face/2859233/20220427162558.png" alt="" />...

    uj5u.com 2023-03-27 14:46:35 more
  • 武裝你的WEBAPI-OData聚合查詢

    <a href="https://www.cnblogs.com/podolski/" target="_blank"><img width="48" height="48" class="pfs" src="https://pic.cnblogs.com/face/616093/20140323000327.png" alt="" /><...

    uj5u.com 2023-03-27 14:46:16 more