Qwen2.5 7B Instruct
Un modèle de langue à 7 milliards de paramètres d'Alibaba, optimisé pour une instruction précise suivant et manipulant des textes longs.
Aperçu général
Qwen2.5 7B Instruire
Description du réseau neuronal Qwen2.5 7B
Qwen2.5 7B Instruct est un modèle de langage libre développé par Alibaba. Il a 7,6 milliards de paramètres et est spécialement réglé pour suivre avec précision les instructions de l'utilisateur. Le modèle peut traiter des textes de plus de 8 000 jetons, analyser des données structurées et retourner les résultats dans des formats lisibles par machine, comme JSON. Par rapport à la version précédente, Qwen2 7B Instruct, le nouveau modèle démontre une amélioration notable des performances en mathématiques et en programmation, et prend également en charge plus de 29 langues — du chinois et de l'anglais au français et à l'espagnol.
Caractéristiques de Qwen2.5 7B Instruct
| Caractéristiques | Valeur |
|---|---|
| Nombre de paramètres | 7,6 milliards |
| Fenêtre contextuelle (jetons d'entrée maximum) | 131 100 jetons |
| Jetons de sortie maximum | 8 200 jetons |
| Date de sortie | 19 septembre 2024 |
| Volume de données sur la formation | 18,0 billions de jetons |
| Score de référence moyen | 65,6 % |
| Licence | Apache 2.0 |
À qui convient le réseau neuronal Qwen2.5 7B Instruire ?
Développeurs et ingénieurs en apprentissage automatique
Le modèle convient à ceux qui construisent des applications sur de grands modèles de langage — des robots de chat aux outils pour la génération automatique de code. La capacité d'affiner le support d'appel et de fonction le rend pratique pour l'intégration dans les systèmes existants.
Chercheurs et analystes de données
Les spécialistes travaillant avec de grands volumes de texte et de données structurées peuvent utiliser Qwen2.5 7B Instruct pour extraire des informations, analyser des documents et générer des rapports en format JSON.
Équipes de produits travaillant avec plusieurs langues
Grâce au soutien