Tag Archives: Qwen 3.8

Qwen 3.8 à 1500 tokens/s : la vitesse d’inférence qui change la donne pour l’IA locale

Qwen 3.8 à 1500 tokenss la vitesse d'inférence qui change la donne pour l'IA locale

On a l’habitude, en intelligence artificielle, de mesurer les progrès en termes d’intelligence : tel modèle répond mieux, raisonne mieux, se trompe moins souvent. Cette semaine, c’est un autre indicateur qui fait le buzz : la vitesse pure. Le fournisseur de puces Cerebras a ajouté le modèle ouvert Qwen 3.8 27B, développé par Alibaba, à sa plateforme d’inférence, avec un …

Lire la suite »