Rumah pembangunan bahagian belakang tutorial php Cara menggunakan Apache Hadoop untuk pengkomputeran teragih dan penyimpanan data dalam pembangunan PHP

Cara menggunakan Apache Hadoop untuk pengkomputeran teragih dan penyimpanan data dalam pembangunan PHP

Jun 25, 2023 am 09:15 AM
php pengkomputeran teragih apache hadoop

Dengan pengembangan berterusan skala Internet dan jumlah data, pengkomputeran dan storan mesin tunggal tidak lagi dapat memenuhi keperluan pemprosesan data berskala besar. Pada masa ini, pengkomputeran teragih dan penyimpanan data menjadi penyelesaian yang diperlukan. Sebagai rangka kerja pengkomputeran teragih sumber terbuka, Apache Hadoop telah menjadi pilihan pertama untuk banyak projek pemprosesan data besar.

Bagaimana untuk menggunakan Apache Hadoop untuk pengkomputeran teragih dan penyimpanan data dalam pembangunan PHP? Artikel ini akan memperkenalkannya secara terperinci dari tiga aspek: pemasangan, konfigurasi dan amalan.

1. Pemasangan

Memasang Apache Hadoop memerlukan langkah berikut:

  1. Muat turun pakej fail binari Apache Hadoop

Anda boleh memuat turunnya dari laman web rasmi Apache Hadoop (http://hadoop.apache.org /releases.html ) untuk memuat turun versi terkini.

  1. Pasang Java

Apache Hadoop ditulis berdasarkan Java, jadi anda perlu memasang Java terlebih dahulu.

  1. Konfigurasikan pembolehubah persekitaran

Selepas memasang Java dan Hadoop, anda perlu mengkonfigurasi pembolehubah persekitaran. Dalam sistem Windows, tambahkan laluan direktori bin Java dan Hadoop kepada pembolehubah persekitaran sistem. Dalam sistem Linux, anda perlu menambah laluan PATH Java dan Hadoop dalam .bashrc atau .bash_profile.

2. Konfigurasi

Selepas memasang Hadoop, beberapa konfigurasi diperlukan untuk menggunakannya seperti biasa. Berikut ialah beberapa konfigurasi penting:

  1. core-site.xml

Laluan fail konfigurasi: $HADOOP_HOME/etc/hadoop/core-site.xml

Dalam fail ini, anda perlu menentukan URI sistem fail lalai dan HDFS Laluan storan fail sementara yang dijana semasa Hadoop sedang berjalan.

Contoh konfigurasi (untuk rujukan sahaja):

<configuration>
  <property>
    <name>fs.defaultFS</name>
    <value>hdfs://localhost:9000</value>
  </property>
  <property>
    <name>hadoop.tmp.dir</name>
    <value>/usr/local/hadoop/tmp</value>
  </property>
</configuration>
Salin selepas log masuk
  1. hdfs-site.xml

Laluan fail konfigurasi: $HADOOP_HOME/etc/hadoop/hdfs-site.xml

Dalam fail ini, salinan HDD perlu ditakrifkan maklumat seperti nombor dan saiz blok.

Konfigurasi sampel (untuk rujukan sahaja):

<configuration>
  <property>
    <name>dfs.replication</name>
    <value>3</value>
  </property>
  <property>
    <name>dfs.blocksize</name>
    <value>128M</value>
  </property>
</configuration>
Salin selepas log masuk
  1. yarn-site.xml

Laluan fail konfigurasi: $HADOOP_HOME/etc/hadoop/yarn-site.xml

Dalam fail ini, anda perlu mentakrifkan YARN yang berkaitan Maklumat konfigurasi, seperti alamat pengurus sumber, bilangan pengurus nod, dsb.

Konfigurasi sampel (untuk rujukan sahaja):

<configuration>
  <property>
    <name>yarn.resourcemanager.address</name>
    <value>localhost:8032</value>
  </property>
  <property>
    <name>yarn.nodemanager.resource.memory-mb</name>
    <value>8192</value>
  </property>
  <property>
    <name>yarn.nodemanager.resource.cpu-vcores</name>
    <value>4</value>
  </property>
</configuration>
Salin selepas log masuk
  1. mapred-site.xml

Laluan fail konfigurasi: $HADOOP_HOME/etc/hadoop/mapred-site.xml

Konfigurasikan maklumat yang berkaitan bagi Mapred ini fail.

Contoh konfigurasi (untuk rujukan sahaja):

<configuration>
  <property>
    <name>mapreduce.framework.name</name>
    <value>yarn</value>
  </property>
  <property>
    <name>yarn.app.mapreduce.am.env</name>
    <value>HADOOP_MAPRED_HOME=/usr/local/hadoop</value>
  </property>
</configuration>
Salin selepas log masuk

3. Amalkan

Selepas menyelesaikan kerja pemasangan dan konfigurasi di atas, anda boleh mula menggunakan Apache Hadoop untuk pengkomputeran teragih dan penyimpanan data dalam pembangunan PHP.

  1. Menyimpan Data

Dalam Hadoop, data disimpan dalam HDFS. Anda boleh menggunakan kelas Hdfs (https://github.com/vladko/Hdfs) yang disediakan oleh PHP untuk mengendalikan HDFS.

Kod Contoh:

require_once '/path/to/hdfs/vendor/autoload.php';

use AliyunHdfsHdfsClient;

$client = new HdfsClient(['host' => 'localhost', 'port' => 9000]);

// 上传本地文件到HDFS
$client->copyFromLocal('/path/to/local/file', '/path/to/hdfs/file');

// 下载HDFS文件到本地
$client->copyToLocal('/path/to/hdfs/file', '/path/to/local/file');
Salin selepas log masuk
  1. Pengkomputeran Teragih

Hadoop biasanya menggunakan model MapReduce untuk pengkomputeran teragih. Pengiraan MapReduce boleh dilaksanakan menggunakan kelas HadoopStreaming yang disediakan oleh PHP (https://github.com/andreas-glaser/php-hadoop-streaming).

Kod sampel:

(Nota: Kod berikut mensimulasikan operasi pengiraan perkataan dalam Hadoop.)

Kod PHP Mapper:

#!/usr/bin/php
<?php

while (($line = fgets(STDIN)) !== false) {
    // 对每一行数据进行处理操作
    $words = explode(' ', strtolower($line));
    foreach ($words as $word) {
        echo $word."    1
";  // 将每个单词按照‘单词    1’的格式输出
    }
}
Salin selepas log masuk

Kod PHP Reducer:

#!/usr/bin/php
<?php

$counts = [];
while (($line = fgets(STDIN)) !== false) {
    list($word, $count) = explode("    ", trim($line));
    if (isset($counts[$word])) {
        $counts[$word] += $count;
    } else {
        $counts[$word] = $count;
    }
}

// 将结果输出
foreach ($counts as $word => $count) {
    echo "$word: $count
";
}
Salin selepas log masuk

Perintah pelaksanaan di atas

Arahan pelaksanaan di atas:

Data input.txt disalurkan ke dalam mapper.php untuk diproses, kemudian diisih, dan akhirnya hasil output disalurkan ke reducer.php untuk diproses, dan akhirnya bilangan kemunculan setiap perkataan adalah output.

Kelas HadoopStreaming melaksanakan logik asas model MapReduce, menukar data kepada pasangan nilai kunci, memanggil fungsi peta untuk pemetaan, menjana pasangan nilai kunci baharu dan memanggil fungsi pengurangan untuk pemprosesan gabungan.

Kod contoh:

$ cat input.txt | ./mapper.php | sort | ./reducer.php
Salin selepas log masuk

Memandangkan Apache Hadoop ialah rangka kerja pengkomputeran teragih sumber terbuka, ia juga menyediakan banyak API dan alatan lain, seperti HBase, Hive, Pig, dll., yang boleh dipilih mengikut keperluan dalam aplikasi tertentu.

Ringkasan:

Artikel ini memperkenalkan cara menggunakan Apache Hadoop untuk pengkomputeran teragih dan storan data dalam pembangunan PHP. Ia mula-mula menerangkan langkah terperinci pemasangan dan konfigurasi Apache Hadoop, kemudian memperkenalkan cara menggunakan PHP untuk mengendalikan HDFS untuk melaksanakan operasi penyimpanan data, dan akhirnya menggunakan contoh kelas HadoopStreaming untuk menerangkan cara melaksanakan pengkomputeran teragih MapReduce dalam pembangunan PHP.

Atas ialah kandungan terperinci Cara menggunakan Apache Hadoop untuk pengkomputeran teragih dan penyimpanan data dalam pembangunan PHP. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Kenyataan Laman Web ini
Kandungan artikel ini disumbangkan secara sukarela oleh netizen, dan hak cipta adalah milik pengarang asal. Laman web ini tidak memikul tanggungjawab undang-undang yang sepadan. Jika anda menemui sebarang kandungan yang disyaki plagiarisme atau pelanggaran, sila hubungi admin@php.cn

Alat AI Hot

Undresser.AI Undress

Undresser.AI Undress

Apl berkuasa AI untuk mencipta foto bogel yang realistik

AI Clothes Remover

AI Clothes Remover

Alat AI dalam talian untuk mengeluarkan pakaian daripada foto.

Undress AI Tool

Undress AI Tool

Gambar buka pakaian secara percuma

Clothoff.io

Clothoff.io

Penyingkiran pakaian AI

AI Hentai Generator

AI Hentai Generator

Menjana ai hentai secara percuma.

Artikel Panas

R.E.P.O. Kristal tenaga dijelaskan dan apa yang mereka lakukan (kristal kuning)
4 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. Tetapan grafik terbaik
4 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. Cara Memperbaiki Audio Jika anda tidak dapat mendengar sesiapa
4 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌
WWE 2K25: Cara Membuka Segala -galanya Di Myrise
1 bulan yang lalu By 尊渡假赌尊渡假赌尊渡假赌

Alat panas

Notepad++7.3.1

Notepad++7.3.1

Editor kod yang mudah digunakan dan percuma

SublimeText3 versi Cina

SublimeText3 versi Cina

Versi Cina, sangat mudah digunakan

Hantar Studio 13.0.1

Hantar Studio 13.0.1

Persekitaran pembangunan bersepadu PHP yang berkuasa

Dreamweaver CS6

Dreamweaver CS6

Alat pembangunan web visual

SublimeText3 versi Mac

SublimeText3 versi Mac

Perisian penyuntingan kod peringkat Tuhan (SublimeText3)

Panduan Pemasangan dan Naik Taraf PHP 8.4 untuk Ubuntu dan Debian Panduan Pemasangan dan Naik Taraf PHP 8.4 untuk Ubuntu dan Debian Dec 24, 2024 pm 04:42 PM

PHP 8.4 membawa beberapa ciri baharu, peningkatan keselamatan dan peningkatan prestasi dengan jumlah penamatan dan penyingkiran ciri yang sihat. Panduan ini menerangkan cara memasang PHP 8.4 atau naik taraf kepada PHP 8.4 pada Ubuntu, Debian, atau terbitan mereka

Cara Menyediakan Kod Visual Studio (Kod VS) untuk Pembangunan PHP Cara Menyediakan Kod Visual Studio (Kod VS) untuk Pembangunan PHP Dec 20, 2024 am 11:31 AM

Kod Visual Studio, juga dikenali sebagai Kod VS, ialah editor kod sumber percuma — atau persekitaran pembangunan bersepadu (IDE) — tersedia untuk semua sistem pengendalian utama. Dengan koleksi sambungan yang besar untuk banyak bahasa pengaturcaraan, Kod VS boleh menjadi c

Bagaimana anda menghuraikan dan memproses HTML/XML dalam PHP? Bagaimana anda menghuraikan dan memproses HTML/XML dalam PHP? Feb 07, 2025 am 11:57 AM

Tutorial ini menunjukkan cara memproses dokumen XML dengan cekap menggunakan PHP. XML (bahasa markup extensible) adalah bahasa markup berasaskan teks yang serba boleh yang direka untuk pembacaan manusia dan parsing mesin. Ia biasanya digunakan untuk penyimpanan data

Jelaskan JSON Web Tokens (JWT) dan kes penggunaannya dalam PHP API. Jelaskan JSON Web Tokens (JWT) dan kes penggunaannya dalam PHP API. Apr 05, 2025 am 12:04 AM

JWT adalah standard terbuka berdasarkan JSON, yang digunakan untuk menghantar maklumat secara selamat antara pihak, terutamanya untuk pengesahan identiti dan pertukaran maklumat. 1. JWT terdiri daripada tiga bahagian: header, muatan dan tandatangan. 2. Prinsip kerja JWT termasuk tiga langkah: menjana JWT, mengesahkan JWT dan muatan parsing. 3. Apabila menggunakan JWT untuk pengesahan di PHP, JWT boleh dijana dan disahkan, dan peranan pengguna dan maklumat kebenaran boleh dimasukkan dalam penggunaan lanjutan. 4. Kesilapan umum termasuk kegagalan pengesahan tandatangan, tamat tempoh, dan muatan besar. Kemahiran penyahpepijatan termasuk menggunakan alat debugging dan pembalakan. 5. Pengoptimuman prestasi dan amalan terbaik termasuk menggunakan algoritma tandatangan yang sesuai, menetapkan tempoh kesahihan dengan munasabah,

7 Fungsi PHP Saya Menyesal Saya Tidak Tahu Sebelum ini 7 Fungsi PHP Saya Menyesal Saya Tidak Tahu Sebelum ini Nov 13, 2024 am 09:42 AM

Jika anda seorang pembangun PHP yang berpengalaman, anda mungkin merasakan bahawa anda telah berada di sana dan telah melakukannya. Anda telah membangunkan sejumlah besar aplikasi, menyahpenyahpepijat berjuta-juta baris kod dan mengubah suai sekumpulan skrip untuk mencapai op

Program PHP untuk mengira vokal dalam rentetan Program PHP untuk mengira vokal dalam rentetan Feb 07, 2025 pm 12:12 PM

Rentetan adalah urutan aksara, termasuk huruf, nombor, dan simbol. Tutorial ini akan mempelajari cara mengira bilangan vokal dalam rentetan yang diberikan dalam PHP menggunakan kaedah yang berbeza. Vokal dalam bahasa Inggeris adalah a, e, i, o, u, dan mereka boleh menjadi huruf besar atau huruf kecil. Apa itu vokal? Vokal adalah watak abjad yang mewakili sebutan tertentu. Terdapat lima vokal dalam bahasa Inggeris, termasuk huruf besar dan huruf kecil: a, e, i, o, u Contoh 1 Input: String = "TutorialSpoint" Output: 6 menjelaskan Vokal dalam rentetan "TutorialSpoint" adalah u, o, i, a, o, i. Terdapat 6 yuan sebanyak 6

Terangkan pengikatan statik lewat dalam php (statik: :). Terangkan pengikatan statik lewat dalam php (statik: :). Apr 03, 2025 am 12:04 AM

Mengikat statik (statik: :) Melaksanakan pengikatan statik lewat (LSB) dalam PHP, yang membolehkan kelas panggilan dirujuk dalam konteks statik dan bukannya menentukan kelas. 1) Proses parsing dilakukan pada masa runtime, 2) Cari kelas panggilan dalam hubungan warisan, 3) ia boleh membawa overhead prestasi.

Apakah kaedah Magic PHP (__construct, __destruct, __call, __get, __set, dll) dan menyediakan kes penggunaan? Apakah kaedah Magic PHP (__construct, __destruct, __call, __get, __set, dll) dan menyediakan kes penggunaan? Apr 03, 2025 am 12:03 AM

Apakah kaedah sihir PHP? Kaedah sihir PHP termasuk: 1. \ _ \ _ Membina, digunakan untuk memulakan objek; 2. \ _ \ _ Destruct, digunakan untuk membersihkan sumber; 3. \ _ \ _ Call, mengendalikan panggilan kaedah yang tidak wujud; 4. \ _ \ _ Mendapatkan, melaksanakan akses atribut dinamik; 5. \ _ \ _ Set, melaksanakan tetapan atribut dinamik. Kaedah ini secara automatik dipanggil dalam situasi tertentu, meningkatkan fleksibiliti dan kecekapan kod.

See all articles