En 48 heures, deux mondes ont bougé en sens contraire.
Le 2 août, l'Europe a fait entrer en application le volet transparence de son règlement sur l'intelligence artificielle — tout en repoussant de 16 mois les obligations les plus lourdes, celles qui concernent directement l'emploi et la formation.
Le 3 août, Alibaba a lancé Qwen3.8-Max et publié, cette fois, un tableau de benchmarks complet.
D'un côté la règle recule. De l'autre la puissance accélère. Entre les deux, il y a un formateur, un dirigeant, un adulte qui se demande quel métier tiendra encore debout dans 5 ans. Et une compétence qui devient décisive : savoir distinguer une promesse, une preuve et une décision.
Vous dirigez un organisme de formation, vous formez des adultes, ou vous vous demandez simplement si l'accélération des modèles d'IA doit changer quelque chose à votre trajectoire. Vous y trouverez la lecture honnête des chiffres publiés par Alibaba — victoires et défaites comprises —, ce que le calendrier européen impose déjà, et une méthode en 3 temps pour tester un modèle sans subir le bruit. Aucune connaissance technique n'est requise.
- 48 heures qui résument 2026
- 2 400 milliards de paramètres, 95 au travail
- Le tableau : ce qu'Alibaba gagne, ce qu'Alibaba perd
- Le vrai signal n'est pas le score
- Ce que ça change pour la formation
- Tester, mesurer, gouverner
48 heures qui résument 2026
| 2 août — Bruxelles | 3 août — Hangzhou | |
|---|---|---|
| Événement | Volet transparence de l'AI Act applicable | Lancement de Qwen3.8-Max |
| Message | « On se donne du temps » | « On accélère » |
| Conséquence | Obligations haut risque repoussées | Premier modèle de classe Max à poids ouverts annoncés |
| Ce que ça déplace | La contrainte réglementaire | Le coût d'accès à la puissance |
Ces deux mouvements ne se contredisent pas. Ils se complètent d'une manière inconfortable : au moment précis où l'outil devient plus puissant et plus accessible, l'obligation formelle de le maîtriser s'éloigne.
La responsabilité, elle, ne disparaît pas. Elle redescend simplement d'un cran — sur les organisations, et sur les professionnels.
2 400 milliards de paramètres, 95 au travail
Le chiffre impressionne. Pris seul, il explique pourtant assez peu la performance réelle.
Qwen3.8-Max repose sur une architecture dite mélange d'experts. Imaginez une immense équipe de spécialistes : le modèle ne convoque pas tout le monde pour chaque mot. Un système de routage sélectionne les parties les plus utiles à la tâche en cours. Sur les 2 400 milliards de paramètres disponibles, 95 milliards travaillent à chaque étape.
La distinction est décisive pour toute décision d'investissement. Les paramètres totaux décrivent la capacité globale du système. Les paramètres actifs donnent l'ordre de grandeur du calcul réellement mobilisé. Mais les poids complets doivent malgré tout être stockés, même si une fraction seulement travaille à chaque instant.
Autrement dit : « poids ouverts » ne voudra pas dire « installable sur n'importe quel ordinateur ». À titre d'ordre de grandeur, une quantification sur 4 bits représenterait déjà environ 1,2 téraoctet de poids bruts, avant surcoûts techniques. Une seule carte graphique de calcul haut de gamme en embarque 141 gigaoctets.
L'auto-hébergement de la version Max restera donc réservé à des infrastructures lourdes. Nous verrons plus loin pourquoi ce n'est pas cette version qui devrait vous intéresser.
Le tableau : ce qu'Alibaba gagne, ce qu'Alibaba perd
Le 19 juillet, l'affirmation « deuxième modèle du monde, juste derrière Fable 5 » reposait sur des évaluations internes non publiées. C'était un signal, pas une démonstration.
Le 3 août, Alibaba a publié son tableau complet. Et il faut lui reconnaître une chose : le groupe y a laissé ses défaites.

| Épreuve — ce qu'elle mesure | Qwen3.8-Max | Claude Fable 5 | GPT-5.6 Sol |
|---|---|---|---|
| PaperBench — reproduire un résultat de recherche | 93,0 | 88,8 | 90,5 |
| IFBench — suivre une consigne à la lettre | 82,8 | 63,5 | 72,7 |
| OSWorld-Verified — piloter un ordinateur | 86,1 | 85,0 | 83,2 |
| Terminal-Bench 2.1 — agir en ligne de commande | 86,6 | 84,6 | 88,8 |
| SWE-bench Pro — génie logiciel | 67,7 | 80,0 | 64,6 |
| HLE — connaissances expertes | 43,6 | 53,3 | 47,2 |
3 victoires chacun. Le classement dépend de la tâche.
| Gagnant | Sur quelles épreuves | Ce que ça veut dire concrètement |
|---|---|---|
| Qwen3.8-Max | PaperBench, IFBench, OSWorld-Verified | Reproduire un protocole, suivre une consigne à la lettre, piloter une interface |
| Claude Fable 5 | SWE-bench Pro, HLE | Écrire et corriger du code exigeant, mobiliser des connaissances expertes |
| GPT-5.6 Sol | Terminal-Bench 2.1 | Enchaîner des commandes dans un terminal |
Ce tableau dit l'essentiel : il n'y a pas de vainqueur, il y a des terrains. Choisir son modèle sans savoir sur quelle tâche on l'emploie, c'est acheter un outil sans savoir ce qu'on veut fabriquer.
Là où Qwen impressionne vraiment, c'est sur PaperBench : reproduire les résultats d'un article de recherche, et le meilleur score du tableau toutes marques confondues. Sur IFBench, l'écart dépasse 19 points. Suivre exactement une consigne sans broder ni dériver paraît une qualité modeste ; elle est en réalité centrale dès qu'on automatise un processus.
Là où il décroche, c'est sur les connaissances expertes — dernier du groupe de tête — et sur le génie logiciel, où l'écart avec Claude Fable 5 atteint 12 points.
3 précautions de lecture, et elles comptent autant que les chiffres.
Ces résultats sont produits par le vendeur. Alibaba a choisi les épreuves, les réglages et les outils. Cela ne les invalide pas : cela impose de les traiter comme une déclaration documentée, pas comme un audit indépendant.
Les classements publics restent préliminaires. Le nombre de votes sur les arènes communautaires est encore 3 à 4 fois inférieur à celui des modèles installés depuis des mois. Les positions bougeront.
Il n'existe pas de « deuxième meilleur modèle du monde ». Il existe un modèle excellent sur la reproduction de recherche et le suivi d'instructions, en retrait sur le génie logiciel avancé et les connaissances expertes. C'est tout, et c'est déjà beaucoup.
Le vrai signal n'est pas le score

L'annonce la plus importante du 3 août est passée presque inaperçue.
En même temps que les poids de Qwen3.8-Max, Alibaba a confirmé l'ouverture de ceux d'une version compacte de la même génération — 27 milliards de paramètres.
Pourquoi cela change tout ? Parce qu'un modèle de cette taille tient sur une machine de travail sérieuse ou un petit serveur. Pas sur un cluster à plusieurs centaines de milliers d'euros. C'est la première fois qu'un modèle de génération frontière devient réellement hébergeable par un organisme de formation.
| Niveau | Ce que vous pouvez faire | Ce que vous ne pouvez pas faire |
|---|---|---|
| Service par API | Utiliser le modèle immédiatement | Le posséder, l'auditer, garantir où vont les données |
| Poids ouverts | Télécharger, héberger, adapter selon la licence | Reproduire l'entraînement |
| Open source complet | Code, licence permissive, méthodes documentées | — |
Au moment où j'écris, les poids ne sont pas téléchargeables et la licence définitive n'est pas connue. Le mot juste reste donc : poids ouverts annoncés. La différence n'est pas sémantique — elle détermine ce qu'une organisation pourra modifier, héberger, auditer ou intégrer dans une offre. C'est exactement la question que je posais déjà à propos de Kimi K3 et de son ouverture revendiquée.
Ce que ça change pour la formation
Dans un organisme de formation, la bonne question n'est jamais « quel est le plus gros modèle ». C'est : quelle tâche pouvons-nous mieux réaliser, avec quelle preuve de qualité, et sous quelle responsabilité humaine ?
La règle a reculé, votre responsabilité non.
Les obligations qui pèsent sur les systèmes à haut risque ont été repoussées. Et le règlement y classe explicitement l'emploi, les ressources humaines, l'éducation et la formation professionnelle. Mais tout n'a pas été reporté, loin de là.
| Obligation | Depuis quand | Ce que ça impose concrètement |
|---|---|---|
| Littératie en IA | Février 2025 — en vigueur | Garantir une compétence suffisante chez ceux qui utilisent ou supervisent l'outil |
| Transparence | 2 août 2026 — en vigueur | Qu'une personne sache qu'elle a affaire à une machine : chatbot, compte rendu généré, contenu pédagogique |
| Haut risque — emploi, éducation, formation | Repoussée | Documentation, gestion des risques, supervision humaine, journalisation |
2 lectures fausses circulent déjà. Celle qui titre « tout est reporté » et referme le dossier. Et celle qui agite le montant des amendes sans préciser ce qui est réellement dû.
Retenez ceci : acheter un outil tiers ne transfère aucune de ces responsabilités. Vous restez co-responsable de ce que vous déployez. Le sursis n'est pas une pause — c'est une piste de décollage.
La littératie n'est pas une contrainte, c'est un marché. Chaque entreprise qui utilise l'IA doit désormais former ses salariés à la comprendre, la superviser et en repérer les limites. Ce n'est pas une obligation de plus pour les organismes de formation : c'est une demande solvable inscrite dans le droit européen, que très peu d'acteurs ont commencé à outiller sérieusement. La question n'est pas de savoir si ce marché existe, mais qui saura y répondre avec autre chose qu'un diaporama de trois heures sur les prompts qui marchent.
Les compétences qui montent ne sont pas celles de production. Regardez à nouveau les épreuves du tableau : elles ne mesurent plus la capacité à répondre à une question, mais celle de produire un livrable dans un flux de travail réel. La frontière qui bouge n'est plus « la machine sait-elle répondre » — elle est devenue « la machine sait-elle livrer, sur la durée, sans qu'on lui tienne la main ». Ce qui se valorise, alors, ce sont le cadrage (savoir spécifier), le contrôle (savoir vérifier) et l'arbitrage (savoir décider). Un adulte en reconversion qui développe ces trois-là ne mise pas sur un outil, il mise sur une posture. C'est ce que je détaille dans se former à l'IA sans être technicien.
La souveraineté des données devient enfin réaliste. Un dossier de reconversion contient un CV, un salaire, parfois une situation de handicap, une difficulté familiale, un élément de santé. Ces informations ne devraient jamais partir dans un service externe par simple curiosité technique. Jusqu'ici, l'argument « hébergeons notre propre modèle » se heurtait au mur du coût. Avec un modèle compact à poids ouverts, ce mur baisse sérieusement. 3 vérifications avant tout usage professionnel : où les données sont-elles traitées et conservées, sont-elles réutilisées pour l'entraînement, et qui peut y accéder sous quelle clause contractuelle.
Le coût de l'outil pédagogique s'effondre. Pas celui de la pédagogie. Un responsable pédagogique peut partir d'un besoin métier, produire un prototype, le tester avec un petit groupe, le faire sécuriser. Le gain ne vient pas du code spectaculaire produit d'un coup — il vient de la vitesse d'itération entre l'idée, la preuve et la correction. Mais un outil n'est pas pédagogique parce qu'il fonctionne : il l'est parce qu'il produit un apprentissage vérifiable. Les critères d'évaluation et la traçabilité restent des exigences documentées, indépendamment de qui a écrit le code — c'est le socle de la formation professionnelle pour adultes.
Tester, mesurer, gouverner
Ma méthode tient en 3 temps, et je l'applique à chaque nouveau modèle annoncé.
| Étape | Ce que vous faites | Critère de sortie |
|---|---|---|
| 1. Tester une situation réelle | 3 tâches déjà réalisées dans votre activité, avec des données anonymisées. Jamais une démonstration conçue pour impressionner. | Vous avez comparé sur votre terrain, pas sur celui du vendeur |
| 2. Mesurer avant de préférer | Exactitude, temps gagné, corrections nécessaires, coût, stabilité | Vous savez si le travail total baisse, ou s'il se déplace |
| 3. Gouverner avant d'automatiser | Qui vérifie, qui peut lancer l'outil, quelles données sont interdites, que faire en cas d'erreur | Un nom figure en face de chaque décision |
Le meilleur modèle n'est pas celui qui produit la plus belle première réponse. C'est celui qui réduit durablement le travail total sans déplacer le risque vers l'utilisateur.
Une automatisation sans responsable humain n'est pas une innovation. C'est une responsabilité abandonnée.
Ce que je retiens
Qwen3.8-Max n'est plus une promesse. Son architecture est documentée, ses résultats sont publiés, ses poids arrivent. Alibaba installe un modèle de pointe crédible face aux laboratoires américains, et le fait en ouvrant — ce qui n'était pas arrivé sur sa gamme haute.
Mais il n'existe toujours pas de deuxième meilleur modèle du monde. Il y a un modèle excellent sur certaines tâches, en retrait sur d'autres, et dont le vrai apport pour un organisme de formation n'est pas la version qui fait les titres, mais la petite sœur qu'on pourra héberger chez soi.
Voilà la lecture adulte de cette actualité : ne pas minimiser le basculement, ne pas avaler le slogan.
Nous n'avons pas besoin de choisir un camp dans la guerre des modèles. Nous avons besoin d'apprendre à lire les preuves, à protéger les personnes, et à utiliser la technologie là où elle ouvre réellement une trajectoire.
Une société qui forme ses citoyens à vérifier l'IA construit de l'autonomie. Une société qui leur apprend seulement à cliquer construit de la dépendance.
FAQ
Qwen3.8-Max est-il meilleur que Claude Fable 5 ?
Pas de manière générale. Selon le tableau publié par Alibaba le 3 août 2026, Qwen3.8-Max devance Claude Fable 5 sur PaperBench (93,0 contre 88,8), IFBench (82,8 contre 63,5) et OSWorld-Verified (86,1 contre 85,0). Il reste derrière sur SWE-bench Pro (67,7 contre 80,0) et HLE (43,6 contre 53,3). 3 victoires chacun : le résultat dépend de la tâche.
Combien de paramètres utilise-t-il réellement ?
Le modèle en contient 2 400 milliards au total, mais en active 95 milliards à chaque étape grâce à son architecture en mélange d'experts. Le nombre total décrit la capacité globale ; le nombre actif renseigne mieux sur le calcul mobilisé.
Est-il open source ?
Non, pas encore. Alibaba annonce la publication des poids pour la semaine suivant le 3 août, mais les fichiers ne sont pas disponibles et la licence définitive n'est pas publiée. La formulation rigoureuse est « poids ouverts annoncés ».
Peut-on l'installer sur un ordinateur personnel ?
Pas dans sa version Max : les 2 400 milliards de poids doivent être stockés, soit environ 1,2 téraoctet en quantification 4 bits. La version compacte à 27 milliards de paramètres, également annoncée en poids ouverts, sera en revanche accessible à une machine de travail ou un petit serveur.
Un organisme de formation est-il concerné par le règlement européen sur l'IA ?
Oui. Le règlement classe à haut risque les systèmes utilisés dans l'éducation, la formation professionnelle, l'emploi et les ressources humaines. Ces obligations ont été repoussées, mais celles de transparence s'appliquent depuis le 2 août 2026 et celle de littératie en IA depuis février 2025.
Faut-il changer d'outil dès maintenant ?
Non. La bonne décision cette semaine n'est pas de migrer, c'est de tester sur 3 tâches réelles et de comparer sur 5 critères. Une architecture professionnelle doit pouvoir passer d'un modèle à l'autre sans être reconstruite à chaque changement de classement.
Aller plus loin
Le nom du modèle changera. La méthode doit rester.
Pour la comparaison de référence sur le modèle auquel Alibaba se mesure, voyez ce que Claude Fable 5 change pour votre métier. Pour l'usage concret de ces outils dans un parcours de transition, l'IA en phase d'exploration pose les limites autant que les possibilités. Et le panorama complet reste sur la page IA et reconversion professionnelle.
Si vous vous demandez ce que ces mutations impliquent pour votre propre parcours, commencez par poser votre situation à plat : faire mon bilan gratuit en 3 minutes.
Soyez libre de vos pensées et de vos décisions, toujours.
Sources consultées le 3 août 2026 : annonce officielle de l'équipe Qwen (Alibaba) et son tableau de benchmarks du 3 août 2026 ; Commission européenne, approche européenne de l'intelligence artificielle ; classements communautaires d'arènes publiques, édition août 2026.