InternVL
par OpenGVLab
The OpenGVLab InternVL2-8B is a cutting-edge multimodal large language model that combines the InternViT-300M-448px vision encoder, an MLP projector, and the internlm2_5-7b-chat language model, enabling it to excel at tasks like image description, visual reasoning, and document analysis. Optimized for both efficiency and performance, it supports instruction-tuned multimodal interactions, achieves competitive results on benchmarks like MathVista, and can be deployed via frameworks like Hugging Face Transformers or LMDeploy, with options for 4-bit quantization to speed up inference.
Score de transparence
Pondéré sur quatre piliers · mis à jour le June 19, 2026
Capacités
Informations sur le fournisseur
Informations complètes sur le fournisseur/prestataire de cette application IA
Informations fournisseur (Règlement IA de l’UE)
Risques potentiels
1 points d'attention identifiés
Révision recommandée avant utilisation
Ces points d'attention sont automatiquement identifiés sur la base d'informations publiquement disponibles sur le fournisseur et les données du catalogue IA. Les risques réels peuvent varier selon votre cas d'usage et votre implémentation spécifiques.
Obtenez des informations sur les risques en exécutant des évaluations sur cette application IA.
Vous travaillez chez OpenGVLab ? Revendiquez cette fiche pour corriger ou compléter les données.
Prêt à gérer vos applications IA ?
Suivez, évaluez et gouvernez vos applications IA avec Anove.