백엔드 개발 PHP 튜토리얼 PHP 한자를 병음 소스 코드로 변환(GB2312 클래스 라이브러리, 약 6000자 지원)

PHP 한자를 병음 소스 코드로 변환(GB2312 클래스 라이브러리, 약 6000자 지원)

Jul 23, 2016 am 08:55 AM

클래스 라이브러리, PHP


최근 프로젝트에서는 프론트엔드용 데이터를 제공하기 위해 개발언어로 PHP를 사용했는데, 글자별로 정렬이 가능하려면 중국어 병음을 추출해야 해서 이 프로젝트를 사용했습니다. 한자를 병음으로 변환하는 스크립트를 작성하려면 스크립트가 비교적 간단하고 주석도 비교적 상세하므로 여기서는 자세히 설명하지 않고 코드만 살펴보겠습니다.

사용법:

  1. $py = new PinYin();
  2. $ all_py = $py->get_all_py("武國伟"); //['wu','guo','wei'] 출력, 문자열 출력 및 조인 메서드 호출('',$all_py)
  3. $first_py = $py->get_first_py($all_py);//wgw 출력
  4. $first_letter = $py->get_first_letter($all_py);//wgw 출력
코드 복사


소스코드:

  1. /**
  2. *---------------------------------- -- --------
  3. * PHP는 한자를 병음으로 변환
  4. * ------------- -- -------------
  5. * 사용법:
  6. * $py = new PinYin();
  7. * $all_py = $py->get_all_py("武國伟"); //['wu','guo','wei'] 출력, 문자열 출력 및 조인 메소드 호출('',$all_py)
  8. * $first_py = $py->get_first_py($all_py);//wgw 출력
  9. * $first_letter = $py->get_first_letter($all_py);//wgw 출력
  10. *
  11. * ---- --------------------------------- ----
  12. */
  13. class PinYin
  14. {
  15. private $dict_list = 배열 (
  16. 'a' => -20319, 'ai' => -20317, 'an' => -20304, 'ang' => -20295, 'ao' => -20292,
  17. 'ba' => -20283, 'bai' => -20257, 'bang' => -20230 => -20051, 'ben' => -20032, 'bi' => -20002, 'biao' => , 'bie' => -19982, 'bing' => -19805, 'bu' => ca' => -19775, 'cai' => -19774, 'can' => -19756, 'cao' => -19751 -19746, 'ceng' => -19741, 'cha' => -19728, 'chan' => -19715 ' => -19540, 'che' => -19525, 'cheng' => -19500, '종' - 19484, 'chou' => -19479, 'chui' => -19289, 'chuang' => -19281 => -19275, '춘' => -19270, '츄오' => -19263, 'ci' => -19261, '콩' => -19249, '쿠' => -19243, 'cu' => -19242, '쿠안' => -19238, 'cui' => -19235, '쿤' => -19227, 'cuo' => -19224,
  18. '다' => -19218, '다이' => -19212, '단' => -19038, '당' => -19023, '다오' => -19018, '드' => -19006, '뎅' => -19003, '디' => -18996, '디안' => -18977, '디아오' => -18961, '죽다' => -18952, '딩' => -18783, '디우' => -18774, '동' => -18773, '두' => -18763, '두' => -18756, '두안' => -18741, 'dui' => -18735, '던' => -18731, '듀오' => -18722,
  19. 'e' => -18710, 'ko' => -18697, '어' => -18696,
  20. '파' => -18526, '팬' => -18518, '팡' => -18501, '페이' => -18490, '펜' => -18478, '펑' => -18463, 'fo' => -18448, '포우' => -18447, '푸' => -18446,
  21. '가' => -18239, '가이' => -18237, '간' => -18231, '깡패' => -18220, '가오' => -18211, 'ge' => -18201, '게이' => -18184, '겐' => -18183, 'geng' => -18181, '공' => -18012, '고우' => -17997, '구' => -17988, '구아' => -17970, '과이' => -17964, '구안' => -17961, '광' => -17950, 'gui' => -17947,
  22. '총' => -17931, '구오' => -17928,
  23. '하' => -17922, '하이' => -17759, '한' => -17752, '멈춤' => -17733, '하오' => -17730, '그 사람' => -17721, '안녕하세요' => -17703, '암탉' => -17701, '헹' => -17697, '홍' => -17692, '허우' => -17683, 'hu' => -17676, '화' => -17496, '화이' => -17487, '환' => -17482, '황' => -17468, '후이' => -17454,
  24. '훈' => -17433, '후오' => -17427,
  25. '지' => -17417, '지아' => -17202, '지안' => -17185, '장' => -16983, '지아오' => -16970, '지예' => -16942, '진' => -16915, '징' => -16733, '지옹' => -16708, '지우' => -16706, '주' => -16689, '주안' => -16664, '주에' => -16657, '준' => -16647,
  26. '카' => -16474, '카이' => -16470, '칸' => -16465, '강' => -16459, '카오' => -16452, '케' => -16448, '켄' => -16433, '켕' => -16429, '콩' => -16427, '코우' => -16423, '구' => -16419, '쿠아' => -16412, '쿠아이' => -16407, '쿠안' => -16403, '꽝' => -16401, '쿠이' => -16393, '군' => -16220, '쿠오' => -16216,
  27. '라' => -16212, '라이' => -16205, 'lan' => -16202, '언어' => -16187, '라오어' => -16180, '르' => -16171, '레이' => -16169, '길이' => -16158, '리' => -16155, '리아' => -15959, '리안' => -15958, '량' => -15944, '랴오' => -15933, '거짓말' => -15920, '린' => -15915, '링' => -15903, '리우' => -15889,
  28. '긴' => -15878, '루' => -15707, '루' => -15701, 'lv' => -15681, '루안' => -15667, '루' => -15661, '룬' => -15659, '루오' => -15652,
  29. '엄마' => -15640, '마이' => -15631, '남자' => -15625, '망' => -15454, '마오' => -15448, '나' => -15436, '메이' => -15435, '남자' => -15419, '멍' => -15416, '미' => -15408, '미안' => -15394, '먀오족' => -15385, '미에' => -15377, '최소' => -15375, '밍' => -15369, '미우' => -15363, '모' => -15362, '모' => -15183, '뮤' => -15180,
  30. '나' => -15165, '나이' => -15158, '난' => -15153, '낭' => -15150, '나오' => -15149, '네' => -15144, '네이' => -15143, '넨' => -15141, '셩' => -15140, '니' => -15139, '니안' => -15128, '냐앙' => -15121, '냐오' => -15119, '니' => -15117, '닌' => -15110, '닝' => -15109, '뉴' => -14941,
  31. '농' => -14937, '뉴' => -14933, 'nv' => -14930, '누안' => -14929, '누에' => -14928, '누오' => -14926,
  32. 'o' => -14922, 'ou' => -14921,
  33. '빠' => -14914, '파이' => -14908, '팬' => -14902, '팡' => -14894, '파오' => -14889, '페이' => -14882, '펜' => -14873, '펭' => -14871, '파이' => -14857, '피안' => -14678, '피아오' => -14674, '파이' => -14670, '핀' => -14668, '핑' => -14663, '포' => -14654, '푸' => -14645,
  34. '치' => -14630, '키아' => -14594, '치안' => -14429, '치앙' => -14407, '교' => -14399, 'qie' => -14384, '친' => -14379, '칭' => -14368, 'qiong' => -14355, '치우' => -14353, 'qu' => -14345, '콴' => -14170, 'que' => -14159, 'qun' => -14151,
  35. '란' => -14149, '울림' => -14145, '라오' => -14140, '다시' => -14137, '렌' => -14135, '렝' => -14125, '리' => -14123, '롱' => -14122, '루' => -14112, '루' => -14109, '루안' => -14099, '루이' => -14097, '실행' => -14094, '루오' => -14092,
  36. '사' => -14090, '사이' => -14087, '산' => -14083, '상' => -13917, '사오' => -13914, 'se' => -13910, '센' => -13907, '셍' => -13906, '샤' => -13905, '샤이' => -13896, '샨' => -13894, '상' => -13878, '샤오' => -13870, '그녀' => -13859, '쉔' => -13847, '성' => -13831, '시' => -13658, '수' => -13611, '슈' => -13601, '슈아' => -13406, '슈아이' => -13404, '슈안' => -13400, '슈앙' => -13398, '슈이' => -13395, '슌' => -13391, '슈오' => -13387, '시' => -13383, '노래' => -13367, 'sou' => -13359, '수' => -13356, '수안' => -13343, '수이' => -13340, '태양' => -13329, '수오' => -13326,
  37. '타' ​​=> -13318, '타이' => -13147, '황갈색' => -13138, '탱' => -13120, '타오' => -13107, '테' => -13096, '텡' => -13095, 'ti' => -13091, '티안' => -13076, '티아오' => -13068, '넥타이' => -13063, '팅' => -13060, '통' => -12888, '토우' => -12875, '투' => -12871, '투안' => -12860, 'tui' => -12858, 'tun' => -12852, '투오' => -12849,
  38. '와' => -12838, '와이' => -12831, '완' => -12829, '왕' => -12812, '웨이' => -12802, '원' => -12607, '웽' => -12597, '워' => -12594, '우' => -12585,
  39. 'xi' => -12556, '샤' => -12359, '시안' => -12346, '샹' => -12320, '샤오' => -12300, 'xie' => -12120, '신' => -12099, '싱' => -12089, 'xiong' => -12074, '슈' => -12067, 'xu' => -12058, '쉬안' => -12039, 'xue' => -11867, 'xun' => -11861,
  40. 'ya' => -11847, 'yan' => -11798, 'yao' => -11604, 'yi' => ; -11589, 'ying' => -11358, 'yong' => -11339, ' 유' => -11303, '위안' => -11077, '윤' => -11067,
  41. 'zai' => -11052, 'zan' => -11041, 'zao' => -11024, 'zei' => , 'zen' => -11019, 'zha' => -11014, 'zhan' => -10832 > -10815, 'zhao' => -10790, 'zhen' => -10764, 'zhi' => 'zhong' => -10544, 'zhuan' => -10519, 'zhua' => -10329 ; -10328, 'zhui' => -10315, 'zhuo' => -10307, ​​-10296 , 'zong' => -10281, 'zou' => -10270, 'zuan' => -10262, ' zun' => -10256, 'zuo' => -10254
  42. );
  43. /**
  44. * 모든 병음을 가져오고 'Zhang Sanfeng'과 같은 병음 배열을 반환합니다. ==> ['zhang','san','feng']
  45. * @param $chinese
  46. * @ param string $ charset
  47. * @return 배열
  48. */
  49. 공용 함수 get_all_py($chinese, $charset = 'utf-8')
  50. {
  51. if ($charset != 'gb2312') $chinese = $this->_U2_Utf8_Gb($chinese);
  52. $py = $this->zh_to_pys ($ 중국어);
  53. return $py;
  54. }
  55. /**
  56. * 병음의 첫 글자를 가져옵니다(예: ['zhang','san','feng'] ==> zsf
  57. * @param $all_pys
  58. * @return string
  59. */
  60. 공개 함수 get_first_py($all_pys)
  61. {
  62. if ( count($all_pys) <= 0) {
  63. return '';
  64. }
  65. $result = [];
  66. foreach ($all_pys를 $one으로) {
  67. if (is_null($one) || strlen($one) <= 0) {
  68. 계속;
  69. }
  70. $result[] = substr($one, 0, 1);
  71. }
  72. return Join('', $result);
  73. }
  74. /**
  75. * 병음의 첫 글자 가져오기(예: ['zhang','san','feng'] ==> z
  76. * @param $all_pys
  77. * @return string
  78. */
  79. 공개 함수 get_first_letter($all_pys)
  80. {
  81. if (count($all_pys) <= 0) {
  82. return '';
  83. }
  84. foreach ($all_pys as $one) {
  85. if (is_null($ one) || strlen($one) <= 0) {
  86. 계속;
  87. }
  88. return substr($one, 0, 1);
  89. }
  90. return ' ';
  91. }
  92. 비공개 함수 _U2_Utf8_Gb($_C)
  93. {
  94. $_String = '';
  95. if ($_C < 0x80) $_String .= $_C;
  96. elseif ($_C < 0x800) {
  97. $_String .= chr(0xC0 | $_C >> 6);
  98. $_String .= chr(0x80 | $_C & 0x3F);
  99. } elseif ($_C < 0x10000) {
  100. $_String .= chr(0xE0 | $_C >> 12);
  101. $_String .= chr(0x80 | $_C >> 6 & 0x3F );
  102. $_String .= chr(0x80 | $_C & 0x3F);
  103. } elseif ($_C < 0x200000) {
  104. $_String .= chr(0xF0 | $_C >> ; 18 );
  105. $_String .= chr(0x80 | $_C >> 12 & 0x3F);
  106. $_String .= chr(0x80 | $_C >> 6 & 0x3F);
  107. $ _String .= chr(0x80 | $_C & 0x3F);
  108. }
  109. return iconv('UTF-8', 'GB2312', $_String);
  110. }
  111. 비공개 function zh_to_py ($num, $blank = '')
  112. {
  113. if ($num > 0 && $num < 160) {
  114. return chr($num);
  115. } elseif ( $num < -20319 || $num > -10247) {
  116. return $blank;
  117. } else {
  118. foreach ($this->dict_list as $py => $code)
  119. if ($code > $num) break;
  120. $result = $py;
  121. }
  122. return $result;
  123. }
  124. }
  125. 비공개 함수 zh_to_pys( $chinese)
  126. {
  127. $result = array();
  128. for ($i = 0; $i < strlen($chinese); $i ) {
  129. $p = ord (substr ($chinese, $i, 1));
  130. if ($p > 160) {
  131. $q = ord(substr($chinese, $i, 1));
  132. $p = $ p * 256 $q - 65536;
  133. }
  134. $result[] = $this->zh_to_py($p);
  135. }
  136. return $result;
  137. }
  138. }
코드 복사


본 웹사이트의 성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.

핫 AI 도구

Undresser.AI Undress

Undresser.AI Undress

사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover

AI Clothes Remover

사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool

Undress AI Tool

무료로 이미지를 벗다

Clothoff.io

Clothoff.io

AI 옷 제거제

AI Hentai Generator

AI Hentai Generator

AI Hentai를 무료로 생성하십시오.

인기 기사

R.E.P.O. 에너지 결정과 그들이하는 일 (노란색 크리스탈)
3 몇 주 전 By 尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 최고의 그래픽 설정
3 몇 주 전 By 尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 아무도들을 수없는 경우 오디오를 수정하는 방법
3 몇 주 전 By 尊渡假赌尊渡假赌尊渡假赌
WWE 2K25 : Myrise에서 모든 것을 잠금 해제하는 방법
4 몇 주 전 By 尊渡假赌尊渡假赌尊渡假赌

뜨거운 도구

메모장++7.3.1

메모장++7.3.1

사용하기 쉬운 무료 코드 편집기

SublimeText3 중국어 버전

SublimeText3 중국어 버전

중국어 버전, 사용하기 매우 쉽습니다.

스튜디오 13.0.1 보내기

스튜디오 13.0.1 보내기

강력한 PHP 통합 개발 환경

드림위버 CS6

드림위버 CS6

시각적 웹 개발 도구

SublimeText3 Mac 버전

SublimeText3 Mac 버전

신 수준의 코드 편집 소프트웨어(SublimeText3)

Laravel의 플래시 세션 데이터로 작업합니다 Laravel의 플래시 세션 데이터로 작업합니다 Mar 12, 2025 pm 05:08 PM

Laravel은 직관적 인 플래시 방법을 사용하여 임시 세션 데이터 처리를 단순화합니다. 응용 프로그램에 간단한 메시지, 경고 또는 알림을 표시하는 데 적합합니다. 데이터는 기본적으로 후속 요청에만 지속됩니다. $ 요청-

PHP의 컬 : REST API에서 PHP Curl Extension 사용 방법 PHP의 컬 : REST API에서 PHP Curl Extension 사용 방법 Mar 14, 2025 am 11:42 AM

PHP 클라이언트 URL (CURL) 확장자는 개발자를위한 강력한 도구이며 원격 서버 및 REST API와의 원활한 상호 작용을 가능하게합니다. PHP CURL은 존경받는 다중 프로모토콜 파일 전송 라이브러리 인 Libcurl을 활용하여 효율적인 execu를 용이하게합니다.

Laravel 테스트에서 단순화 된 HTTP 응답 조롱 Laravel 테스트에서 단순화 된 HTTP 응답 조롱 Mar 12, 2025 pm 05:09 PM

Laravel은 간결한 HTTP 응답 시뮬레이션 구문을 제공하여 HTTP 상호 작용 테스트를 단순화합니다. 이 접근법은 테스트 시뮬레이션을보다 직관적으로 만들면서 코드 중복성을 크게 줄입니다. 기본 구현은 다양한 응답 유형 단축키를 제공합니다. Illuminate \ support \ Facades \ http를 사용하십시오. http :: 가짜 ([ 'google.com'=> ​​'Hello World', 'github.com'=> ​​[ 'foo'=> 'bar'], 'forge.laravel.com'=>

Codecanyon에서 12 개의 최고의 PHP 채팅 스크립트 Codecanyon에서 12 개의 최고의 PHP 채팅 스크립트 Mar 13, 2025 pm 12:08 PM

고객의 가장 긴급한 문제에 실시간 인스턴트 솔루션을 제공하고 싶습니까? 라이브 채팅을 통해 고객과 실시간 대화를 나누고 문제를 즉시 해결할 수 있습니다. 그것은 당신이 당신의 관습에 더 빠른 서비스를 제공 할 수 있도록합니다.

PHP에서 늦은 정적 결합의 개념을 설명하십시오. PHP에서 늦은 정적 결합의 개념을 설명하십시오. Mar 21, 2025 pm 01:33 PM

기사는 PHP 5.3에 도입 된 PHP의 LSB (Late STATIC BING)에 대해 논의하여 정적 방법의 런타임 해상도가보다 유연한 상속을 요구할 수있게한다. LSB의 실제 응용 프로그램 및 잠재적 성능

프레임 워크 사용자 정의/확장 : 사용자 정의 기능을 추가하는 방법. 프레임 워크 사용자 정의/확장 : 사용자 정의 기능을 추가하는 방법. Mar 28, 2025 pm 05:12 PM

이 기사에서는 프레임 워크에 사용자 정의 기능 추가, 아키텍처 이해, 확장 지점 식별 및 통합 및 디버깅을위한 모범 사례에 중점을 둡니다.

프레임 워크 보안 기능 : 취약점 보호. 프레임 워크 보안 기능 : 취약점 보호. Mar 28, 2025 pm 05:11 PM

기사는 입력 유효성 검사, 인증 및 정기 업데이트를 포함한 취약점을 방지하기 위해 프레임 워크의 필수 보안 기능을 논의합니다.

See all articles