PHP が文字列の長さをインターセプトする (中国語と英語の混合文字列)

ホームページ

バックエンド開発

PHPチュートリアル

PHP が文字列の長さをインターセプトする (中国語と英語の混合文字列)_PHP チュートリアル

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

Jul 13, 2016 pm 04:56 PM

php 中国語関数弦インターセプトサポート記事やっとの自分のものを持参してください長さ

この記事では、PHP に付属するインターセプト関数から、最終的に中国語、英語、および中国語と英語の混合文字列インターセプト方法をサポートするまでの文字列インターセプト関数を紹介しています。必要な友人は参照してください。

文字列の一部を取得します。

構文: string substr(string string, int start, int [length]);

戻り値: 文字列

機能タイプ: データ処理

コンテンツの説明

この関数は、文字列の開始位置から長さの文字を抽出します。 start が負の数の場合、文字列の末尾から開始されます。省略されたパラメータ長が存在するが、負の数の場合は、下からの長さの文字を取得することを意味します。

使用例

コードは次のとおりです	コードをコピー
echo substr("abcdef", 1, 3); // "bcd" を返します echo substr("abcdef", -2); // "ef" を返します echo substr("abcdef", -3, 1); // "d" を返します echo substr("abcdef", 1, -1); // "bcde" を返します ?>

上記は英語のみをサポートしており、中国語はサポートしていません

GB2312 中国語文字列をインターセプトします

コードは次のとおりです	コードをコピー
//中国語の文字列をインターセプトします関数 mysubstr($str, $start, $len) { $tmpstr = ""; $strlen = $start + $len ; for($i = 0; $i If(ord(substr($str, $i, 1)) > 0xa0) { $tmpstr .= substr($str, $i, 2); $i++; } 他 $tmpstr .= substr($str, $i, 1); } $tmpstr を返す } ?> utf8 でエンコードされたマルチバイト文字列をインターセプトします

コードは次のとおりです

コードをコピー // utf8 文字列をインターセプトします関数 utf8Substr($str, $from, $len)

{

preg_replace('#^(?:[x00-x7F]|[xC0-xFF][x80-xBF]+){0,'.$from.'}' を返します。
'((?:[x00-x7F]|[xC0-xFF][x80-xBF]+){0,'.$len.'}).*#s',
‘$1’,$str); }
?>

/*
※機能：文字化けしない点以外はsubstrと同じです
* パラメータ:
* リターン:
*/

コードは次のとおりです

コードをコピー

関数 utf8_substr( $str , $start , $length=null ){

//最初にそれを傍受します $res = substr( $str, $start, $length);
$strlen = strlen( $str );

/* 次に、最初と最後の 6 バイトが完全である (不完全ではない) かどうかを判断します */

// パラメータ start が正の数の場合

if ( $start >= 0 ){
// 約 6 バイト前方をインターセプトします
$next_start = $start + $length; // 初期位置
; $next_len = $next_start + 6 $next_segm = substr( $str , $next_start , $next_len );

// 最初のバイトが完全な文字の最初のバイトではない場合、末尾から約 6 バイトをインターセプトします

$prev_start = $start - 6 > $start - 6 : 0; $prev_segm = substr( $str , $prev_start , $start - $prev_start );
}
// 開始は負の数です
その他{
// 約 6 バイト前方をインターセプトします
$next_start = $strlen + $start + $length; // 初期位置
; $next_len = $next_start + 6 $next_segm = substr( $str , $next_start , $next_len );
// 最初のバイトが完全な文字の最初のバイトではない場合、約 6 バイトをインターセプトします。
$start = $strlen + $start;
$prev_start = $start - 6 > $start - 6 : 0; $prev_segm = substr( $str , $prev_start , $start - $prev_start );
}

// 最初の 6 バイトが utf8 ルールに準拠しているかどうかを判断します
If ( preg_match( '@^([x80-xBF]{0,5})[xC0-xFD]?@' , $next_segm , $bytes ) ){
If ( !empty( $bytes[1] ) ){

$bytes = $bytes[1];

$res .= $bytes;
}
}

// 最後の 6 バイトが utf8 ルールに準拠しているかどうかを判断します
$ord0 = ord( $res[0] );
If ( 128 = $ord0 ){
// それを元に戻し、res の前に追加します。
If ( preg_match( '@[xC0-xFD][x80-xBF]{0,5}$@' , $prev_segm , $bytes ) ){
If ( !empty( $bytes[0] ) ) {
$bytes = $bytes[0];
$res = $bytes;
}
}
}

$res を返す;
}

テストデータ::

コードは次のとおりです

コードをコピー

$str = 'dfjdjf test 13f test 65&2 data¹（1 is mfe&...just';
var_dump( utf8_substr( $str , 22 , 12 ) ); echo '
var_dump( utf8_substr( $str , 22 , -6 ) ); echo '
var_dump( utf8_substr( $str , 9 , 12 ) ); echo '
var_dump( utf8_substr( $str , 19 , 12 ) ); echo '
var_dump( utf8_substr( $str , 28 , -6 ) ); echo '

显示结果::(截取无乱码, 欢迎大家测试, 提交bug)
string(12) "据ｆｄｊ"
string(26) "据ｆｄｊ（1就mfe&…"
string(13) "13f试65&2数"
string(12) "数据ｆｄ"
string(20) "ｄｊ（1就mfe&…"

把我常用的分享出来

下面我们再来看中文截函数吧。

代码如下

复制代码

function MooCutstr($string, $length, $dot = ' ...') {
global $charset;

if(strlen($string) <= $length) {
return $string;
}
$string = str_replace(array('&', '"', '<', '>'), array('&', '"', '<', '>'), $string);
$strcut = '';
if(strtolower($charset) == 'utf-8') {
$n = $tn = $noc = 0;
while($n < strlen($string)) {
$t = ord($string[$n]);
if($t == 9 || $t == 10 || (32 <= $t && $t <= 126)) {
$tn = 1; $n++; $noc++;
} elseif (194 <= $t && $t <= 223) {
$tn = 2; $n += 2; $noc += 2;
} elseif (224 <= $t && $t < 239) {
$tn = 3; $n += 3; $noc += 2;
} elseif (240 <= $t && $t <= 247) {
$tn = 4; $n += 4; $noc += 2;
} elseif (248 <= $t && $t <= 251) {
$tn = 5; $n += 5; $noc += 2;
} elseif ($t == 252 || $t == 253) {
$tn = 6; $n += 6; $noc += 2;
} else {
$n++;
}
if($noc >= $length) {
    break;
   }
}
if($noc > $length) {
   $n -= $tn;
}
$strcut = substr($string, 0, $n);
} else {
for($i = 0; $i < $length; $i++) {
$strcut .= ord($string[$i]) > 127 ? $string[$i].$string[++$i] : $string[$i];
}
}
//$strcut = str_replace(array('&', '"', '<', '>'), array('&', '"', '<', '>'), $strcut);

return $strcut.$dot;
}

このウェブサイトの声明

この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。

ホットAIツール

Undresser.AI Undress

リアルなヌード写真を作成する AI 搭載アプリ

AI Clothes Remover

写真から衣服を削除するオンライン AI ツール。

Undress AI Tool

脱衣画像を無料で

Clothoff.io

AI衣類リムーバー

Video Face Swap

完全無料の AI 顔交換ツールを使用して、あらゆるビデオの顔を簡単に交換できます。

ホットツール

メモ帳++7.3.1

使いやすく無料のコードエディター

SublimeText3 中国語版

中国語版、とても使いやすい

ゼンドスタジオ 13.0.1

強力な PHP 統合開発環境

ドリームウィーバー CS6

ビジュアル Web 開発ツール

SublimeText3 Mac版

神レベルのコード編集ソフト（SublimeText3）

ホットトピック

Gmailメールのログイン入り口はどこですか？

7675

CakePHP チュートリアル

1393

C# チュートリアル

1207

Steamのアカウント名の形式は何ですか

Win11 Activation Key Permanent

Related knowledge

Ubuntu および Debian 用の PHP 8.4 インストールおよびアップグレードガイド Dec 24, 2024 pm 04:42 PM

PHP 8.4 では、いくつかの新機能、セキュリティの改善、パフォーマンスの改善が行われ、かなりの量の機能の非推奨と削除が行われています。このガイドでは、Ubuntu、Debian、またはその派生版に PHP 8.4 をインストールする方法、または PHP 8.4 にアップグレードする方法について説明します。

今まで知らなかったことを後悔している 7 つの PHP 関数 Nov 13, 2024 am 09:42 AM

あなたが経験豊富な PHP 開発者であれば、すでにそこにいて、すでにそれを行っていると感じているかもしれません。あなたは、運用を達成するために、かなりの数のアプリケーションを開発し、数百万行のコードをデバッグし、大量のスクリプトを微調整してきました。

PHP 開発用に Visual Studio Code (VS Code) をセットアップする方法 Dec 20, 2024 am 11:31 AM

Visual Studio Code (VS Code とも呼ばれる) は、すべての主要なオペレーティングシステムで利用できる無料のソースコードエディター (統合開発環境 (IDE)) です。多くのプログラミング言語の拡張機能の大規模なコレクションを備えた VS Code は、

JSON Web Tokens（JWT）とPHP APIでのユースケースを説明してください。 Apr 05, 2025 am 12:04 AM

JWTは、JSONに基づくオープン標準であり、主にアイデンティティ認証と情報交換のために、当事者間で情報を安全に送信するために使用されます。 1。JWTは、ヘッダー、ペイロード、署名の3つの部分で構成されています。 2。JWTの実用的な原則には、JWTの生成、JWTの検証、ペイロードの解析という3つのステップが含まれます。 3. PHPでの認証にJWTを使用する場合、JWTを生成および検証でき、ユーザーの役割と許可情報を高度な使用に含めることができます。 4.一般的なエラーには、署名検証障害、トークンの有効期限、およびペイロードが大きくなります。デバッグスキルには、デバッグツールの使用とロギングが含まれます。 5.パフォーマンスの最適化とベストプラクティスには、適切な署名アルゴリズムの使用、有効期間を合理的に設定することが含まれます。

PHPでHTML/XMLを解析および処理するにはどうすればよいですか？ Feb 07, 2025 am 11:57 AM

このチュートリアルでは、PHPを使用してXMLドキュメントを効率的に処理する方法を示しています。 XML（拡張可能なマークアップ言語）は、人間の読みやすさとマシン解析の両方に合わせて設計された多用途のテキストベースのマークアップ言語です。一般的にデータストレージに使用されます

母音を文字列にカウントするPHPプログラム Feb 07, 2025 pm 12:12 PM

文字列は、文字、数字、シンボルを含む一連の文字です。このチュートリアルでは、さまざまな方法を使用してPHPの特定の文字列内の母音の数を計算する方法を学びます。英語の母音は、a、e、i、o、u、そしてそれらは大文字または小文字である可能性があります。母音とは何ですか？母音は、特定の発音を表すアルファベットのある文字です。大文字と小文字など、英語には5つの母音があります。 a、e、i、o、u 例1 入力：string = "tutorialspoint" 出力：6 説明する文字列「TutorialSpoint」の母音は、u、o、i、a、o、iです。合計で6元があります

PHPでの後期静的結合を説明します（静的：:)。 Apr 03, 2025 am 12:04 AM

静的結合（静的：:) PHPで後期静的結合（LSB）を実装し、クラスを定義するのではなく、静的コンテキストで呼び出しクラスを参照できるようにします。 1）解析プロセスは実行時に実行されます。2）継承関係のコールクラスを検索します。3）パフォーマンスオーバーヘッドをもたらす可能性があります。

PHPマジックメソッド（__construct、__destruct、__call、__get、__setなど）とは何ですか？ Apr 03, 2025 am 12:03 AM

PHPの魔法の方法は何ですか？ PHPの魔法の方法には次のものが含まれます。1。\ _ \ _コンストラクト、オブジェクトの初期化に使用されます。 2。\ _ \ _リソースのクリーンアップに使用される破壊。 3。\ _ \ _呼び出し、存在しないメソッド呼び出しを処理します。 4。\ _ \ _ get、dynamic属性アクセスを実装します。 5。\ _ \ _セット、動的属性設定を実装します。これらの方法は、特定の状況で自動的に呼び出され、コードの柔軟性と効率を向上させます。

See all articles

PHP が文字列の長さをインターセプトする (中国語と英語の混合文字列)_PHP チュートリアル

ホットAIツール

Undresser.AI Undress

AI Clothes Remover

Undress AI Tool

Clothoff.io

Video Face Swap

人気の記事

ホットツール

メモ帳++7.3.1

SublimeText3 中国語版

ゼンドスタジオ 13.0.1

ドリームウィーバー CS6

SublimeText3 Mac版

ホットトピック