Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas-AI-php.cn

Jadual Kandungan

Pengenalan kaedah

Eksperimen dan keputusan

Rumah

Peranti teknologi

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

Apr 04, 2023 am 11:35 AM

bingkai

Huawei HiSilicon Canada Research Institute dan University of Alberta bersama-sama melancarkan rangka kerja ramalan prestasi rangkaian saraf berdasarkan pra-latihan dan suntikan pengetahuan.

Penilaian prestasi rangkaian saraf (ketepatan, ingat semula, PSNR, dll.) memerlukan banyak sumber dan masa dan merupakan kesesakan utama carian struktur rangkaian saraf (NAS). Kaedah NAS awal memerlukan sumber yang luas untuk melatih setiap struktur baharu yang dicari dari awal. Dalam beberapa tahun kebelakangan ini, peramal prestasi rangkaian menarik lebih banyak perhatian sebagai kaedah penilaian prestasi yang cekap.

Walau bagaimanapun, peramal semasa terhad dalam skop penggunaannya kerana mereka hanya boleh memodelkan struktur rangkaian daripada ruang carian tertentu dan hanya boleh meramalkan prestasi struktur baharu pada tugasan tertentu. Sebagai contoh, sampel latihan hanya mengandungi rangkaian pengelasan dan ketepatannya, jadi peramal terlatih hanya boleh digunakan untuk menilai prestasi struktur rangkaian baharu pada tugas pengelasan imej.

Untuk memecahkan sempadan ini dan membolehkan peramal meramalkan prestasi struktur rangkaian tertentu pada pelbagai tugas dan mempunyai keupayaan silang tugas dan generalisasi silang data, Institut Penyelidikan Huawei HiSilicon Canada dan Universiti Alberta bersama-sama memperkenalkan rangka kerja ramalan prestasi rangkaian saraf berdasarkan pra-latihan dan suntikan pengetahuan. Rangka kerja ini boleh menilai dengan cepat prestasi struktur dan jenis rangkaian yang berbeza pada pelbagai jenis tugas CV seperti klasifikasi, pengesanan, segmentasi, dll. untuk carian struktur rangkaian saraf. Kertas penyelidikan telah diterima oleh AAI 2023.

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Pautan kertas: https://arxiv.org/abs/2211.17228
Pautan kod: https://github.com/Ascend -Penyelidikan/AIO-P

Pendekatan AIO-P (All-in-One Predictors) bertujuan untuk memperluaskan skop peramal saraf kepada tugas penglihatan komputer melangkaui klasifikasi. AIO-P menggunakan teknologi K-Adapter untuk menyuntik pengetahuan berkaitan tugas ke dalam model peramal, dan juga mereka bentuk mekanisme penskalaan label berdasarkan FLOP (Operan Titik Terapung) untuk menyesuaikan diri dengan penunjuk prestasi dan pengedaran yang berbeza. AIO-P menggunakan skim pelabelan pseudo yang unik untuk melatih Penyesuai K, menjana sampel latihan baharu dalam beberapa minit sahaja. Keputusan eksperimen menunjukkan bahawa AIO-P mempamerkan keupayaan ramalan prestasi yang kukuh dan mencapai keputusan MAE dan SRCC yang cemerlang pada beberapa tugas penglihatan komputer. Di samping itu, AIO-P boleh secara langsung berhijrah dan meramalkan prestasi struktur rangkaian yang tidak pernah dilihat sebelum ini, dan boleh bekerjasama dengan NAS untuk mengoptimumkan jumlah pengiraan rangkaian sedia ada tanpa mengurangkan prestasi.

Pengenalan kaedah

AIO-P ialah peramal prestasi rangkaian umum yang boleh digeneralisasikan kepada berbilang tugas. AIO-P mencapai keupayaan ramalan prestasi merentas tugas dan ruang carian melalui pra-latihan peramal dan suntikan pengetahuan khusus domain. AIO-P menggunakan teknologi K-Adapter untuk menyuntik pengetahuan berkaitan tugasan ke dalam peramal, dan bergantung pada format graf pengiraan (CG) biasa untuk mewakili struktur rangkaian, akhirnya membolehkannya menyokong rangkaian daripada ruang carian dan tugasan yang berbeza, seperti yang ditunjukkan dalam Rajah 1 di bawah.

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Rajah 1. Bagaimana AIO-P mewakili struktur rangkaian untuk tugas yang berbeza

Selain itu, mekanisme penandaan pseudo Penggunaan AIO-P boleh menjana sampel latihan baharu dengan pantas untuk melatih Penyesuai K. Untuk merapatkan jurang antara julat pengukuran prestasi pada tugas yang berbeza, AIO-P mencadangkan kaedah penskalaan label berdasarkan FLOP untuk mencapai pemodelan prestasi merentas tugas. Keputusan eksperimen yang meluas menunjukkan bahawa AIO-P mampu membuat ramalan prestasi yang tepat pada pelbagai tugas CV yang berbeza, seperti anggaran pose dan pembahagian, tanpa memerlukan sampel latihan atau dengan hanya sedikit penalaan halus. Selain itu, AIO-P boleh menilai prestasi dengan betul pada struktur rangkaian yang tidak pernah dilihat sebelum ini dan, apabila digabungkan dengan algoritma carian, digunakan untuk mengoptimumkan rangkaian pengecaman muka Huawei, mengekalkan prestasinya tidak berubah dan mengurangkan FLOP lebih daripada 13.5%. Kertas tersebut telah diterima oleh AAAI-23 dan kod tersebut telah dibuka sumbernya pada GitHub.

Rangkaian penglihatan komputer biasanya terdiri daripada "tulang belakang" yang melakukan pengekstrakan ciri dan "kepala" yang menggunakan ciri yang diekstrak untuk membuat ramalan. Struktur "tulang belakang" biasanya direka berdasarkan struktur rangkaian tertentu yang diketahui (ResNet, Inception, MobileNet, ViT, UNet), manakala "kepala" direka untuk tugas tertentu, seperti klasifikasi, anggaran pose, segmentasi, dll direka. Penyelesaian NAS tradisional secara manual menyesuaikan ruang carian berdasarkan struktur "tulang belakang". Contohnya, jika "tulang belakang" ialah MobileNetV3, ruang carian mungkin termasuk bilangan Blok MBConv, parameter setiap MBConv (saiz kernel, pengembangan. ), bilangan saluran, dsb. Walau bagaimanapun, ruang carian tersuai ini tidak universal Jika terdapat satu lagi "tulang belakang" yang direka berdasarkan ResNet, ia tidak boleh dioptimumkan melalui rangka kerja NAS sedia ada, tetapi ruang carian perlu direka bentuk semula.

Untuk menyelesaikan masalah ini, AIO-P memilih untuk mewakili struktur rangkaian yang berbeza daripada peringkat graf pengiraan, mencapai perwakilan bersatu bagi mana-mana struktur rangkaian. Seperti yang ditunjukkan dalam Rajah 2, format graf pengiraan membolehkan AIO-P mengekod pengepala dan tulang belakang bersama-sama untuk mewakili keseluruhan struktur rangkaian. Ini juga membolehkan AIO-P meramalkan prestasi rangkaian daripada ruang carian yang berbeza (seperti MobileNets dan ResNets) pada pelbagai tugas.

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Rajah 2. Perwakilan modul Squeeze-and-Excite dalam MobileNetV3 pada tahap graf pengiraan

Dicadangkan dalam AIO- P Struktur peramal bermula daripada model regresi GNN tunggal (Rajah 3, blok hijau), yang meramalkan prestasi rangkaian pengelasan imej. Untuk menambah pengetahuan tentang tugas CV lain, seperti pengesanan atau segmentasi, kajian itu melampirkan Penyesuai K (Rajah 3, blok oren) pada model regresi asal. K-Adapter dilatih mengenai sampel daripada tugasan baharu, manakala berat model asal dibekukan. Oleh itu, kajian ini secara berasingan melatih berbilang K-Adapter (Rajah 4) untuk menambah pengetahuan daripada pelbagai tugas.

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Rajah 3. Peramal AIO-P dengan Penyesuai K

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Rajah 4. Peramal AIO-P dengan berbilang K-Adapter

Untuk mengurangkan lagi kos latihan setiap K-Adapter, kajian ini mencadangkan teknologi pelabelan pseudo yang bijak. Teknik ini menggunakan skema pensampelan terpendam untuk melatih model "kepala" yang boleh dikongsi antara tugas yang berbeza. Kepala kongsi kemudiannya boleh digandingkan dengan mana-mana tulang belakang rangkaian dalam ruang carian dan diperhalusi untuk menghasilkan label pseudo dalam masa 10-15 minit (Rajah 5).

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Rajah 5. Melatih model "kepala" yang boleh dikongsi antara tugas yang berbeza

Telah terbukti secara eksperimen bahawa menggunakan kongsi kepala Label pseudo yang diperolehi berkorelasi positif dengan prestasi sebenar yang diperoleh dengan melatih rangkaian dari awal selama sehari atau lebih, kadangkala dengan pekali korelasi pangkat melebihi 0.5 (korelasi Spearman).

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Selain itu, tugasan yang berbeza akan mempunyai penunjuk prestasi yang berbeza. Penunjuk prestasi ini biasanya mempunyai selang pengedaran khusus mereka sendiri Contohnya, rangkaian pengelasan yang menggunakan tulang belakang tertentu mungkin mempunyai ketepatan klasifikasi kira-kira 75% pada ImageNet, manakala mAP pada tugas pengesanan objek MS-COCO mungkin 30-35 %. . Untuk mengambil kira selang yang berbeza ini, kajian ini mencadangkan satu kaedah untuk memahami prestasi rangkaian daripada taburan normal berdasarkan konsep normalisasi. Dalam istilah orang awam, jika nilai yang diramalkan ialah 0, prestasi rangkaian adalah purata jika >0 adalah rangkaian yang lebih baik, tanpa mengira tugas, set data atau penunjuk, seperti yang ditunjukkan dalam Rajah 6; di bawah.

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Rajah 6. Cara menormalkan prestasi rangkaian

FLOP rangkaian berkaitan dengan saiz model, data input dan secara amnya berkorelasi positif dengan trend Berkaitan prestasi. Kajian ini menggunakan transformasi FLOP untuk meningkatkan label yang AIO-P belajar daripadanya.

Eksperimen dan keputusan

Kajian ini mula-mula melatih AIO-P mengenai anggaran pose manusia dan tugas pengesanan objek, dan kemudian menggunakannya untuk meramalkan prestasi struktur rangkaian pada berbilang tugas, termasuk anggaran pose ( LSP dan MPII), pengesanan (OD), segmentasi instance (IS), segmentasi semantik (SS) dan segmentasi panoramik (PS). Walaupun dalam kes penghijrahan langsung sifar pukulan, gunakan AIO-P untuk meramalkan prestasi rangkaian daripada ruang carian Sekali-untuk-Semua (OFA) (ProxylessNAS, MobileNetV3 dan ResNet-50) pada tugasan ini dan ramalan akhir keputusan MAE kurang daripada 1.0% dan korelasi kedudukan melebihi 0.5 telah dicapai.

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Selain itu, kajian ini juga menggunakan AIO-P untuk meramalkan prestasi rangkaian dalam perpustakaan model sumber terbuka TensorFlow-Slim (seperti model segmentasi semantik DeepLab, ResNets, Inception nets, MobileNets dan EfficientNets), struktur rangkaian ini mungkin tidak muncul dalam sampel latihan AIO-P.

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

AIO-P boleh mencapai SRCC yang hampir sempurna pada 3 perpustakaan model segmentasi semantik DeepLab, memperoleh SRCC positif pada semua 4 perpustakaan model klasifikasi dan mencapai SRCC=1.0 pada model EfficientNet dengan menggunakan transformasi FLOP.

Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas

Akhir sekali, motivasi teras AIO-P adalah untuk dapat menggandingkannya dengan algoritma carian dan menggunakannya untuk mengoptimumkan struktur rangkaian sewenang-wenangnya, secara bebas dan bukan milik mana-mana Struktur ruang carian atau perpustakaan model yang diketahui, atau bahkan satu untuk tugas yang tidak pernah dilatih. Kajian ini menggunakan AIO-P dan algoritma carian mutasi rawak untuk mengoptimumkan model pengecaman muka (FR) yang digunakan pada telefon mudah alih Huawei Keputusan menunjukkan bahawa AIO-P boleh mengurangkan pengiraan model FLOP lebih daripada 13.5% sambil mengekalkan prestasi (ketepatan. (Pr) dan ingat (Rc)).

Pembaca yang berminat boleh membaca teks asal kertas untuk mengetahui lebih lanjut butiran penyelidikan.

Atas ialah kandungan terperinci Memecahkan kesesakan NAS, kaedah baharu AIO-P meramalkan prestasi seni bina merentas tugas. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Kenyataan Laman Web ini

Kandungan artikel ini disumbangkan secara sukarela oleh netizen, dan hak cipta adalah milik pengarang asal. Laman web ini tidak memikul tanggungjawab undang-undang yang sepadan. Jika anda menemui sebarang kandungan yang disyaki plagiarisme atau pelanggaran, sila hubungi admin@php.cn

Alat AI Hot

Undresser.AI Undress

Apl berkuasa AI untuk mencipta foto bogel yang realistik

AI Clothes Remover

Alat AI dalam talian untuk mengeluarkan pakaian daripada foto.

Undress AI Tool

Gambar buka pakaian secara percuma

Clothoff.io

Penyingkiran pakaian AI

AI Hentai Generator

Menjana ai hentai secara percuma.

Tunjukkan Lagi

Artikel Panas

R.E.P.O. Kristal tenaga dijelaskan dan apa yang mereka lakukan (kristal kuning)

3 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌

R.E.P.O. Tetapan grafik terbaik

3 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌

Assassin's Creed Shadows: Penyelesaian Riddle Seashell

2 minggu yang lalu By DDD

R.E.P.O. Cara Memperbaiki Audio Jika anda tidak dapat mendengar sesiapa

3 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌

WWE 2K25: Cara Membuka Segala -galanya Di Myrise

3 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌

Tunjukkan Lagi

Alat panas

Notepad++7.3.1

Editor kod yang mudah digunakan dan percuma

SublimeText3 versi Cina

Versi Cina, sangat mudah digunakan

Hantar Studio 13.0.1

Persekitaran pembangunan bersepadu PHP yang berkuasa

Dreamweaver CS6

Alat pembangunan web visual

SublimeText3 versi Mac

Perisian penyuntingan kod peringkat Tuhan (SublimeText3)

Tunjukkan Lagi

Topik panas

Di manakah pintu masuk log masuk untuk e-mel gmail?

7467

Tutorial CakePHP

1376

Apakah format nama akaun stim

kunci pengaktifan win11 kekal

Sambungan NYT menunjukkan dan jawapan

Tunjukkan Lagi

Related knowledge

Bagaimana untuk menilai keberkesanan kos sokongan komersial untuk rangka kerja Java Jun 05, 2024 pm 05:25 PM

Menilai kos/prestasi sokongan komersial untuk rangka kerja Java melibatkan langkah-langkah berikut: Tentukan tahap jaminan yang diperlukan dan jaminan perjanjian tahap perkhidmatan (SLA). Pengalaman dan kepakaran pasukan sokongan penyelidikan. Pertimbangkan perkhidmatan tambahan seperti peningkatan, penyelesaian masalah dan pengoptimuman prestasi. Timbang kos sokongan perniagaan terhadap pengurangan risiko dan peningkatan kecekapan.

Bagaimanakah keluk pembelajaran rangka kerja PHP berbanding rangka kerja bahasa lain? Jun 06, 2024 pm 12:41 PM

Keluk pembelajaran rangka kerja PHP bergantung pada kecekapan bahasa, kerumitan rangka kerja, kualiti dokumentasi dan sokongan komuniti. Keluk pembelajaran rangka kerja PHP adalah lebih tinggi jika dibandingkan dengan rangka kerja Python dan lebih rendah jika dibandingkan dengan rangka kerja Ruby. Berbanding dengan rangka kerja Java, rangka kerja PHP mempunyai keluk pembelajaran yang sederhana tetapi masa yang lebih singkat untuk bermula.

Bagaimanakah pilihan rangka kerja PHP yang ringan mempengaruhi prestasi aplikasi? Jun 06, 2024 am 10:53 AM

Rangka kerja PHP yang ringan meningkatkan prestasi aplikasi melalui saiz kecil dan penggunaan sumber yang rendah. Ciri-cirinya termasuk: saiz kecil, permulaan pantas, penggunaan memori yang rendah, kelajuan dan daya tindak balas yang dipertingkatkan, dan penggunaan sumber yang dikurangkan: SlimFramework mencipta API REST, hanya 500KB, responsif yang tinggi dan daya pemprosesan yang tinggi.

Perbandingan prestasi rangka kerja Java Jun 04, 2024 pm 03:56 PM

Mengikut penanda aras, untuk aplikasi kecil dan berprestasi tinggi, Quarkus (permulaan pantas, memori rendah) atau Micronaut (TechEmpower cemerlang) adalah pilihan yang ideal. SpringBoot sesuai untuk aplikasi bertindan penuh yang besar, tetapi mempunyai masa permulaan dan penggunaan memori yang lebih perlahan.

Amalan terbaik dokumentasi rangka kerja Golang Jun 04, 2024 pm 05:00 PM

Menulis dokumentasi yang jelas dan komprehensif adalah penting untuk rangka kerja Golang. Amalan terbaik termasuk mengikut gaya dokumentasi yang ditetapkan, seperti Panduan Gaya Pengekodan Google. Gunakan struktur organisasi yang jelas, termasuk tajuk, subtajuk dan senarai, serta sediakan navigasi. Menyediakan maklumat yang komprehensif dan tepat, termasuk panduan permulaan, rujukan API dan konsep. Gunakan contoh kod untuk menggambarkan konsep dan penggunaan. Pastikan dokumentasi dikemas kini, jejak perubahan dan dokumen ciri baharu. Sediakan sokongan dan sumber komuniti seperti isu dan forum GitHub. Buat contoh praktikal, seperti dokumentasi API.

Bagaimana untuk memilih rangka kerja golang terbaik untuk senario aplikasi yang berbeza Jun 05, 2024 pm 04:05 PM

Pilih rangka kerja Go terbaik berdasarkan senario aplikasi: pertimbangkan jenis aplikasi, ciri bahasa, keperluan prestasi dan ekosistem. Rangka kerja Common Go: Gin (aplikasi Web), Echo (Perkhidmatan Web), Fiber (daya pemprosesan tinggi), gorm (ORM), fasthttp (kelajuan). Kes praktikal: membina REST API (Fiber) dan berinteraksi dengan pangkalan data (gorm). Pilih rangka kerja: pilih fasthttp untuk prestasi utama, Gin/Echo untuk aplikasi web yang fleksibel, dan gorm untuk interaksi pangkalan data.

Penjelasan praktikal terperinci pembangunan rangka kerja golang: Soalan dan Jawapan Jun 06, 2024 am 10:57 AM

Dalam pembangunan rangka kerja Go, cabaran biasa dan penyelesaiannya ialah: Pengendalian ralat: Gunakan pakej ralat untuk pengurusan dan gunakan perisian tengah untuk mengendalikan ralat secara berpusat. Pengesahan dan kebenaran: Sepadukan perpustakaan pihak ketiga dan cipta perisian tengah tersuai untuk menyemak bukti kelayakan. Pemprosesan serentak: Gunakan goroutine, mutex dan saluran untuk mengawal akses sumber. Ujian unit: Gunakan pakej, olok-olok dan stub untuk pengasingan dan alat liputan kod untuk memastikan kecukupan. Penerapan dan pemantauan: Gunakan bekas Docker untuk membungkus penggunaan, menyediakan sandaran data dan menjejak prestasi dan ralat dengan alat pengelogan dan pemantauan.

Apakah salah faham yang biasa berlaku dalam proses pembelajaran kerangka Golang? Jun 05, 2024 pm 09:59 PM

Terdapat lima salah faham dalam pembelajaran rangka kerja Go: terlalu bergantung pada rangka kerja dan fleksibiliti terhad. Jika anda tidak mengikut konvensyen rangka kerja, kod tersebut akan menjadi sukar untuk dikekalkan. Menggunakan perpustakaan lapuk boleh menyebabkan isu keselamatan dan keserasian. Penggunaan pakej yang berlebihan mengaburkan struktur kod. Mengabaikan pengendalian ralat membawa kepada tingkah laku yang tidak dijangka dan ranap sistem.

See all articles