100
WeDLM
freemium
WeDLM est un modèle de langage par diffusion de Tencent capable de produire plusieurs tokens en parallèle, avec une vitesse d’inférence jusqu’à 10 fois supérieure aux LLM autorégressifs classiques. Compatible avec l’attention causale standard et le KV cache natif, optimisé via vLLM.
Visiter le siteInformations
Catégorie
LLM models
Tags
LLM models
Langues supportées
EN
Besoin d'aide pour intégrer cet outil ?
Notre équipe peut vous accompagner dans la mise en place et l'intégration de cet outil dans votre entreprise.
Nous contacter