Après Meta à l'étranger, Alibaba est devenu un autre géant de la technologie qui promeut la tendance du « moment Android » des grands modèles d'intelligence artificielle (IA)
Selon les rapports du Beijing Business Daily, Alibaba Cloud publiera le modèle open source de questions et réponses générales Qwen-7B et le modèle de conversation Qwen-7B-Chat le jeudi 3 août. Les deux modèles ont 7 milliards de paramètres. Ils ont lancé la première plateforme ouverte « Model as a Service » en Chine, la Magic Community, et elle peut être utilisée gratuitement, et l'utilisation commerciale est également autorisée
Les utilisateurs peuvent quantifier Qwen-7B et Qwen-7B-Chat via un code open source, ainsi que déployer et exécuter des modèles sur des cartes graphiques grand public. Ils peuvent télécharger directement le modèle depuis la communauté Moda, ou accéder et appeler Qwen-7B et Qwen-7B-Chat via la plateforme Alibaba Cloud Lingji. Alibaba Cloud fournit aux utilisateurs des services comprenant la formation de modèles, l'inférence, le déploiement et le réglage fin
Sur la communauté Magic Tower, il y a un article dédié à la présentation de la méthode d'installation du modèle Tongyi Qianwen, à l'expérience de création d'espace, aux meilleures pratiques de raisonnement du modèle et de formation du modèle, et joint également les captures d'écran du lien du modèle et de la situation de téléchargement.
Selon les informations publiques, Qwen-7B est un modèle de base pré-entraîné utilisant plus de 2,2 billions de jetons après déduplication et filtrage. Il prend en charge plusieurs langues telles que le chinois et l'anglais et a une longueur de fenêtre contextuelle de 8 Ko. Le modèle contient des données de haute qualité en chinois, anglais, multilingues, codes, mathématiques et autres, couvrant l'ensemble du réseau texte, encyclopédie, livres, code, mathématiques et champs verticaux dans divers domaines
Selon les résultats de l'évaluation MMLU, Qwen-7B a obtenu de bons résultats lors de l'évaluation en anglais, surpassant d'autres modèles de pré-formation open source similaires et étant compétitif par rapport aux modèles à plus grande échelle. En termes d'évaluation chinoise, Qwen-7B a obtenu le score le plus élevé sur l'ensemble de validation C-Eval et était compétitif même avec des modèles à plus grande échelle
Ce qui suit est une comparaison des résultats de précision MMLU à 5 tirs du Qwen-7B
Alibaba Cloud a construit un assistant IA Qwen-7B-Chat basé sur le modèle de base via le mécanisme d'alignement. Il s'agit d'un grand modèle linguistique de dialogue chinois et anglais basé sur Transformer, qui a réussi à s'aligner sur la cognition humaine. Ce modèle utilise une variété de données de pré-formation, notamment des textes en ligne, des livres professionnels, des codes, etc., couvrant un large éventail de sujets
La précision zéro du modèle Qwen-7B-Chat sur l'ensemble de validation C-Eval et l'ensemble d'évaluation MMLU dépasse les autres modèles d'alignement similaires
Ce qui suit est une comparaison des résultats de précision du tir zéro sur l'ensemble de test C-Eval
Alibaba Cloud est devenue la première grande entreprise technologique en Chine à rejoindre les rangs des grands modèles open source, en juillet de cette année, elle a publié conjointement une version commerciale du modèle d'IA open source Llama 2 avec Meta, qui peut remplacer OpenAI et les modèles de Google. . En outre, Zhipu AI et Tsinghua KEG Laboratory ont également annoncé le meilleur grand modèle open source de Chine en juillet
L'avantage des modèles open source est d'augmenter l'acceptation des utilisateurs et de fournir plus de données pour le traitement de l'intelligence artificielle. Plus le volume de données de LLM est important, plus sa fonction est puissante. De plus, le modèle open source aide les chercheurs et les développeurs à découvrir et à résoudre les vulnérabilités, améliorant ainsi la technologie et les niveaux de sécurité
Lors de l'Alibaba Cloud Summit en avril 2023, Alibaba a annoncé l'ouverture de Tongyi Qianwen aux entreprises, permettant aux entreprises d'utiliser les capacités de Tongyi Qianwen pour former leurs propres grands modèles
Zhou Jingren, directeur de la technologie (CTO) d'Alibaba Cloud Intelligence Group, a déclaré qu'à l'avenir, les entreprises pourront tirer pleinement parti des capacités Tongyi Qianwen d'Alibaba Cloud et combiner leurs propres connaissances du secteur et leurs propres scénarios d'application pour former de grands modèles d'entreprise personnalisés. Par exemple, chaque entreprise peut disposer de son propre service client intelligent, de son guide d'achat intelligent, de son assistant vocal intelligent, de son assistant de rédaction, de son concepteur d'IA, de son modèle de conduite autonome et d'autres fonctions
Zhang Yong, PDG du groupe Alibaba et PDG d'Alibaba Cloud Intelligence Group, a déclaré que tous les produits Alibaba seront intégrés au grand modèle Tongyi Qianwen
Alibaba Cloud espère aider davantage d'entreprises à utiliser de grands modèles pour s'adapter aux besoins de l'ère de l'IA, afin que chaque entreprise puisse disposer de son propre grand modèle exclusif de capacités industrielles et le reconstruire sur la base de Tongyi Qianwen
Ce qui précède est le contenu détaillé de. pour plus d'informations, suivez d'autres articles connexes sur le site Web de PHP en chinois!