Aller au contenu
100
WeDLM

WeDLM

freemium

WeDLM est un modèle de langage par diffusion de Tencent capable de produire plusieurs tokens en parallèle, avec une vitesse d’inférence jusqu’à 10 fois supérieure aux LLM autorégressifs classiques. Compatible avec l’attention causale standard et le KV cache natif, optimisé via vLLM.

Visiter le site
Partager

Informations

Catégorie LLM models
Tags
LLM models
Langues supportées
EN

Besoin d'aide pour intégrer cet outil ?

Notre équipe peut vous accompagner dans la mise en place et l'intégration de cet outil dans votre entreprise.

Nous contacter
© AtlasAi. Tous droits réservés. Un produit de DigiAtlas