UTF8 인코딩을 PHP에서 구현된 유니코드로 변환하는 함수
풀어 주다: 2016-07-25 09:07:12
-
-
function Utf8ToUnicode(strUtf8) - {
- var bstr = “”;
- var nTotalChars = strUtf8.length; // total chars to be processed.
- var nOffset = 0; // processing point on strUtf8
- var nRemainingBytes = nTotalChars; // how many bytes left to be converted
- var nOutputPosition = 0;
- var iCode, iCode1, iCode2; // the value of the unicode.
while (nOffset < nTotalChars) - {
- iCode = strUtf8.charCodeAt(nOffset);
- if ((iCode & 0×80) == 0) // 1 byte.
- {
- if ( nRemainingBytes < 1 ) // not enough data
- break;
bstr = String.fromCharCode(iCode & 0×7F);
- nOffset ;
- nRemainingBytes -= 1;
- }
- else if ((iCode & 0xE0) == 0xC0) // 2 bytes
- {
- iCode1 = strUtf8.charCodeAt(nOffset 1);
- if ( nRemainingBytes < 2 || // not enough data
- (iCode1 & 0xC0) != 0×80 ) // invalid pattern
- {
- break;
- }
bstr = String.fromCharCode(((iCode & 0×3F) << 6) | ( iCode1 & 0×3F)); - nOffset = 2;
- nRemainingBytes -= 2;
- }
- else if ((iCode & 0xF0) == 0xE0) // 3 bytes
- {
- iCode1 = strUtf8.charCodeAt(nOffset 1);
- iCode2 = strUtf8.charCodeAt(nOffset 2);
- if ( nRemainingBytes < 3 || // not enough data
- (iCode1 & 0xC0) != 0×80 || // invalid pattern
- (iCode2 & 0xC0) != 0×80 )
- {
- break;
- }
bstr = String.fromCharCode(((iCode & 0×0F) << 12) | - ((iCode1 & 0×3F) << 6) |
- (iCode2 & 0×3F));
- nOffset = 3;
- nRemainingBytes -= 3;
- }
- else // 4 or more bytes — unsupported
- break;
- }
if (nRemainingBytes != 0)
- {
- // bad UTF8 string.
- return “”;
- }
return bstr;
- }
- ?>
-
复制代码
|
본 웹사이트의 성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.
저자별 최신 기사
-
2024-10-22 09:46:29
-
2024-10-13 13:53:41
-
2024-10-12 12:15:51
-
2024-10-11 22:47:31
-
2024-10-11 19:36:51
-
2024-10-11 15:50:41
-
2024-10-11 15:07:41
-
2024-10-11 14:21:21
-
2024-10-11 12:59:11
-
2024-10-11 12:17:31