Gradient blur
Blog
Intelligence artificielle
Retour à l'apercu

What's new in GenAI land | Édition 2

Radar IA bimensuel. Deux semaines d'actualité IA se sont écoulées, et la période a été chargée.
29 - 04 - 2026

Les grands laboratoires ont de nouveau propulsé une série de modèles de pointe dans le monde, mais dans le même temps, les fondations craquent sous la course effrénée aux nouvelles versions. Par ailleurs, une annonce Mythos très médiatisée a rapidement été nuancée en profondeur, l'Europe s'est rapprochée d'une IA souveraine, et la recherche a continué à souligner les limites de ce que l'IA peut réellement faire aujourd'hui. Toutes les deux semaines, sur le blog Xylos, nous proposons un aperçu net et honnête de ce qui bouge vraiment dans le monde de l'IA générative, avec le contexte nécessaire.

La base reste l'aperçu LinkedIn bimensuel de Tom Van 't veld, Learning Innovator chez OASE (powered by Xylos). Tom suit de près les évolutions de l'IA, et nous traduisons ses observations en ce qu'elles signifient concrètement pour les organisations et les personnes qui y travaillent. Bienvenue dans cette deuxième édition.

ÉDITION 2 • 29 AVRIL 2026

Voici cinq histoires des deux dernières semaines qui apportent le plus de valeur à votre organisation.

La course aux modèles, la qualité et le paradoxe de la productivité

OpenAI a lancé GPT-5.5 comme « un pas de plus vers une super app », avec un agentic coding et un computer use nettement améliorés, et positionne d'emblée Codex comme un agent de travail plus large, capable d'agir aussi dans votre navigateur, Sheets et Slides. Anthropic a annoncé au même moment Claude Opus 4.7, et quelques jours plus tard, DeepSeek-V4 est sorti, avec des performances proches d'Opus 4.7 et de GPT-5.5 mais à un sixième du prix. Impressionnant, sur le papier.

La pratique raconte une autre histoire. ChatGPT est à nouveau tombé en panne, des utilisateurs se plaignent d'une perte de performance chez Claude, Opus 4.7 a hérité de l'étiquette d'overzealous query cop, et Anthropic a lui-même publié un mea culpa sur de récents problèmes de qualité de Claude Code. La course vers des modèles toujours plus puissants semble si intense que, quelque part dans la chaîne, les fondations commencent à craquer.

Microsoft a par ailleurs rendu les fonctions agentiques de Copilot dans Word, Excel et PowerPoint disponibles en général, l'assistant pouvant désormais aussi gérer des tâches autonomes plus longues dans Excel et Word. Une étape importante qui accélère encore le travail dans Office, même si PCWorld décrit à juste titre l'assistant comme un stagiaire enthousiaste mais inexpérimenté : utilisable sans souci pour le gros du travail, à condition d'examiner l'output d'un œil critique. Cela rejoint ce que montre une étude menée auprès de CIO : environ 40 % des gains de productivité liés à l'IA sont reperdus dans la correction des erreurs. Une analyse distincte en tire une conclusion importante : les entreprises qui optent pour l'augmentation par l'IA plutôt que pour l'automatisation complète en tirent davantage de bénéfices à long terme. Pour qui se lance dans des trajectoires IA, voilà un repère important : investissez autant dans les compétences et la gouvernance que dans les outils.

Claude Design : l'IA participe à la conception

Anthropic a lancé Claude Design, un outil qui assemble en un rien de temps des maquettes UI, des slides et des infographies à partir de langage naturel. Pour qui veut concevoir une première version d'une interface, d'un pitch deck ou d'un rapport sans faire appel tout de suite à un designer ou à une agence externe, c'est un pas en avant notable. Le rythme n'est cependant pas encore tout à fait fluide : des utilisateurs signalent atteindre rapidement leurs limites d'usage.

De son côté, OpenAI a sorti un GPT-Image-2 revu, capable aussi de puiser des informations sur le web, même si les mises en page générées ont été jugées convaincantes en surface, mais inutilisables sur le plan typographique et rédactionnel. Pour qui veut suivre ce que cela change pour les workflows créatifs, cette analyse sur ce que GPT-Image-2 change vraiment est un bon point de départ. Le message pour les équipes marketing, communication et produit reste le même que dans la section précédente : l'IA accélère le processus de conception, mais mieux vaut laisser la touche finale et la relecture éditoriale à un humain.

La saga Mythos : comment apprendre à lire une annonce IA

Début avril, Anthropic a annoncé en grande pompe que son nouveau modèle Mythos avait réussi, pour la première fois, à mener une simulation complète de cyberattaque, incluant la détection de failles et la construction d'exploits fonctionnels. L'entreprise a même jugé Mythos trop dangereux pour une sortie publique et ne l'a rendu disponible, via Project Glasswing, qu'à un cercle restreint de partenaires. Une annonce qui a fait les gros titres sans détour.

Sauf que le battage médiatique a rapidement montré des fissures. Les chercheurs en sécurité ont surtout trouvé un « nothingburger » : la plupart des résultats étaient déjà réalisables avec Opus 4.6 ou des outils open source existants. Le hacker éthique Inti De Ceukelaire a construit en direct un outil de phishing fonctionnel avec Claude en quelques minutes. Le modèle « trop dangereux pour être diffusé » s'est en outre révélé accessible à quiconque pouvait simplement deviner l'URL.

Le volet politique n'était pas non plus aussi net qu'il n'y paraissait. Malgré la précédente déclaration de « liste noire » du Pentagone, la NSA utiliserait déjà Mythos par une voie distincte, tandis que l'agence américaine de cybersécurité CISA n'y a pas eu accès. Lorsqu'OpenAI a sorti GPT-5.4-Cyber une semaine plus tard, clairement positionné comme une réponse, le ton était donné. Mashable pose dès lors la question pertinente de savoir si Mythos est davantage un coup de communication qu'une véritable percée.

Pour les organisations qui doivent évaluer des annonces IA, ce schéma est instructif : les annonces spectaculaires n'ont que rarement d'emblée le poids qu'elles revendiquent dans les communiqués de presse. Le bon réflexe reste de regarder du côté de la recherche indépendante, des spécialistes en sécurité et de l'impact sur votre propre profil de risque.

L'Europe mise sur des alternatives souveraines

Le ton en Europe évolue nettement vers la souveraineté numérique. Le canadien Cohere rachète l'allemand Aleph Alpha pour bâtir une puissance IA transatlantique, explicitement tournée vers une IA souveraine pour les gouvernements et entreprises européens. Avec le soutien des gouvernements allemand et canadien, et un investissement du propriétaire de Lidl, le groupe Schwarz, l'ensemble vise une valorisation d'environ 20 milliards de dollars.

Dans le même esprit, le gouvernement néerlandais met en place sa propre alternative auto-hébergée à GitHub basée sur l'outil open source Forgejo. Le raisonnement reste le même : moins de dépendance envers les géants technologiques américains pour les infrastructures critiques. Pour les organisations belges qui revoient leur stack cloud et IA, cela se traduit par un écosystème d'alternatives en pleine croissance, et par la nécessité de faire des choix réfléchis sur l'emplacement de leurs données, modèles et code.

L'humain reste le contrôle qualité

Le contenu généré par l'IA envahit internet à un rythme stupéfiant. 44 % de toute la nouvelle musique sur le service de streaming Deezer est créée par l'IA, et le chinois iQiyi (souvent surnommé le « Netflix chinois ») reconstruit toute sa plateforme autour de films et séries majoritairement générés par IA. Dans le même temps, la provenance des contenus reçoit davantage d'attention : VRT NWS affiche désormais une vérification IA sur les contenus susceptibles d'avoir été générés par l'IA. À juste titre, car une nouvelle étude montre que les gens parviennent à peine à détecter quand leurs messages WhatsApp ou e-mails ont été rédigés par l'IA.

Deux études mettent aussi douloureusement en évidence les limites de l'IA comme source de conseil. Les modèles d'IA se trompent dans plus de 80 % des cas lors d'un diagnostic patient de première ligne, et des chatbots populaires donnent régulièrement des conseils médicaux erronés sans que les utilisateurs s'en rendent compte. Lorsque des chercheurs se sont présentés à Grok comme étant psychotiques, le chatbot a activement nourri leurs idées délirantes au lieu de les orienter vers de l'aide.

Dans le même temps, la contestation vient d'un endroit surprenant. Le rejet le plus marqué vient en effet de la génération Z, celle qui a grandi avec cette technologie. The Verge avance dans le même sens que la Silicon Valley se focalise sur des fonctionnalités IA que l'utilisateur moyen trouve sans intérêt, voire gênantes. Et la prédiction antérieure selon laquelle les agents IA arpenteraient massivement le monde du travail comme employés virtuels dès 2025 se révèle pour l'instant exagérée, même si une agence de publicité néerlandaise supprime ouvertement des emplois à cause des outils IA et que LinkedIn a lancé un marché du travail IA pour experts.

Le fil conducteur est clair : l'IA ne nous dispense pas de l'esprit critique. Former les collaborateurs au prompt, à l'évaluation et à la lecture critique reste donc un maillon indispensable de toute stratégie IA.

Rendez-vous dans deux semaines pour la prochaine édition.

À propos de Tom Van 't veld

Tom travaille depuis des années chez Xylos, où il a débuté comme formateur Microsoft Office avant de devenir la force motrice derrière des concepts d'apprentissage innovants. Il est à l'origine d'OASE, la plateforme d'apprentissage en ligne de Xylos, et a notamment développé le concept Digital Coach, une application Escape Room sur Microsoft Teams et le jeu mAindset qui permet aux collaborateurs d'apprendre à travailler avec l'IA de manière ludique. En tant que Learning Innovator, il s'intéresse de plus en plus, ces dernières années, à ce que l'IA signifie pour notre façon d'apprendre et de travailler. Envie de réagir ou d'en discuter ? Retrouvez-le sur LinkedIn.