Comment extraire avec précision les noms de domaine des URL en Java ?
Extraction de noms de domaine à partir d'URL
La tâche d'extraction de noms de domaine à partir d'URL se pose fréquemment. Cet article traite d'une implémentation Java courante pour cette tâche et explore des approches alternatives pour améliorer la précision et gérer les cas extrêmes potentiels.
Implémentation initiale
Le code Java fourni commence par normaliser l'URL en ajoutant "http://" si nécessaire. Il analyse ensuite l'URL à l'aide de java.net.URL pour obtenir la chaîne hôte. Enfin, si l'hôte commence par « www », la sous-chaîne après « www ». est renvoyé comme nom de domaine.
Approche alternative
Cependant, cette approche a des limites :
- Elle ne parvient pas à gérer certains cas extrêmes , comme les URL relatives dont les chemins commencent par « http » ou « www ».
- Il suppose que le protocole est toujours en minuscules, ce qui n'est pas une hypothèse valide.
- Il effectue des recherches DNS inutiles pendant Vérifications de l'égalité des URL, qui peuvent conduire à des attaques par déni de service.
Mise en œuvre améliorée
Pour résoudre ces problèmes, nous vous recommandons d'utiliser java.net.URI pour Analyse d'URL. L'URI offre une approche plus robuste et fiable :
<code class="java">public static String getDomainName(String url) throws URISyntaxException { URI uri = new URI(url); String domain = uri.getHost(); return domain.startsWith("www.") ? domain.substring(4) : domain; }</code>
Ce code convertit l'URL en URI, obtient la chaîne hôte et supprime le "www". préfixe s'il est présent.
Considérations supplémentaires
Même avec la mise en œuvre améliorée, il peut encore y avoir certains cas limites à prendre en compte. L'annexe B de la RFC 3986 fournit une expression régulière qui peut gérer des scénarios d'analyse d'URI plus complexes.
Cas extrêmes
Voici quelques cas extrêmes supplémentaires dans lesquels la mise en œuvre initiale peut échouer. pour gérer :
- URL avec plusieurs barres obliques dans le chemin ou l'hôte
- URL avec des caractères codés
- URL avec des chaînes de requête ou des identifiants de fragment
- URL qui se résolvent en noms de domaine non-ASCII
Dans l'ensemble, l'utilisation de java.net.URI pour l'analyse d'URL offre un moyen plus complet et plus précis d'extraire les noms de domaine des URL, en particulier lorsqu'il s'agit de problèmes complexes ou potentiellement URL invalides.
Ce qui précède est le contenu détaillé de. pour plus d'informations, suivez d'autres articles connexes sur le site Web de PHP en chinois!

Outils d'IA chauds

Undresser.AI Undress
Application basée sur l'IA pour créer des photos de nu réalistes

AI Clothes Remover
Outil d'IA en ligne pour supprimer les vêtements des photos.

Undress AI Tool
Images de déshabillage gratuites

Clothoff.io
Dissolvant de vêtements AI

Video Face Swap
Échangez les visages dans n'importe quelle vidéo sans effort grâce à notre outil d'échange de visage AI entièrement gratuit !

Article chaud

Outils chauds

Bloc-notes++7.3.1
Éditeur de code facile à utiliser et gratuit

SublimeText3 version chinoise
Version chinoise, très simple à utiliser

Envoyer Studio 13.0.1
Puissant environnement de développement intégré PHP

Dreamweaver CS6
Outils de développement Web visuel

SublimeText3 version Mac
Logiciel d'édition de code au niveau de Dieu (SublimeText3)

Sujets chauds











Dépannage et solutions au logiciel de sécurité de l'entreprise qui fait que certaines applications ne fonctionnent pas correctement. De nombreuses entreprises déploieront des logiciels de sécurité afin d'assurer la sécurité des réseaux internes. ...

Solutions pour convertir les noms en nombres pour implémenter le tri dans de nombreux scénarios d'applications, les utilisateurs peuvent avoir besoin de trier en groupe, en particulier en un ...

Le traitement de la cartographie des champs dans l'amarrage du système rencontre souvent un problème difficile lors de l'exécution d'amarrage du système: comment cartographier efficacement les champs d'interface du système a ...

Commencez le printemps à l'aide de la version IntelliJideaultimate ...

Lorsque vous utilisez MyBatis-Plus ou d'autres cadres ORM pour les opérations de base de données, il est souvent nécessaire de construire des conditions de requête en fonction du nom d'attribut de la classe d'entité. Si vous manuellement à chaque fois ...

Conversion des objets et des tableaux Java: Discussion approfondie des risques et des méthodes correctes de la conversion de type de distribution De nombreux débutants Java rencontreront la conversion d'un objet en un tableau ...

Explication détaillée de la conception des tables SKU et SPU sur les plates-formes de commerce électronique Cet article discutera des problèmes de conception de la base de données de SKU et SPU dans les plateformes de commerce électronique, en particulier comment gérer les ventes définies par l'utilisateur ...

Comment la solution de mise en cache Redis réalise-t-elle les exigences de la liste de classement des produits? Pendant le processus de développement, nous devons souvent faire face aux exigences des classements, comme l'affichage d'un ...
