Tag Archives: Cerebras

Qwen 3.8 à 1500 tokens/s : la vitesse d’inférence qui change la donne pour l’IA locale

Qwen 3.8 à 1500 tokenss la vitesse d'inférence qui change la donne pour l'IA locale

On a l’habitude, en intelligence artificielle, de mesurer les progrès en termes d’intelligence : tel modèle répond mieux, raisonne mieux, se trompe moins souvent. Cette semaine, c’est un autre indicateur qui fait le buzz : la vitesse pure. Le fournisseur de puces Cerebras a ajouté le modèle ouvert Qwen 3.8 27B, développé par Alibaba, à sa plateforme d’inférence, avec un …

Lire la suite »

Pourquoi votre IA va devenir instantanée en 2027

Pourquoi votre IA va devenir instantanée en 2027

Depuis deux ans, la course à l’intelligence artificielle se résumait à une question simple : quel modèle est le plus intelligent ? Qui résout le mieux les problèmes de maths, qui code sans bug, qui raisonne le plus finement ? Sauf qu’en coulisses, un autre combat, beaucoup moins médiatisé, est en train de prendre le pas sur celui-là : la …

Lire la suite »