 |
|
|
| |
| Bonjour, c’est Alexandre 👋 |
|
|
| C’est la rentrée, et pour une reprise, on a été servis. Cette semaine, on a compté douze nouveaux modèles annoncés. Douze. Le rythme des sorties continue d’accélérer et c’est devenu n’importe quoi : personne ne peut suivre, et surtout personne n’a le temps de tester.
Ajoutez à ça les annonces angoissantes du moment, les rapports de sécurité alarmistes et les milliards annoncés tous les trois jours, et on comprend que beaucoup de monde décroche.
Sauf qu’au milieu de tout ce bruit, il y a quand même des choses qui sortent du lot cette semaine, et qui laissent entrevoir la façon dont des secteurs entiers vont se transformer. On parle de ça aujourd’hui ! |
| Ça peut servir à quelqu’un que vous connaissez ? Envoyez-lui cette édition : par email, sur LinkedIn ou sur WhatsApp. Le message est déjà écrit, il n’y a plus qu’à envoyer. |
|
|
| |
| Au programme |
| → |
Les deux détails qui rendent enfin les agents IA utilisables au quotidien |
|
| → |
Trois nouveaux modèles sortent la même semaine, tous ne méritent pas votre temps |
|
| → |
L’interface qui se génère à la volée : Runway montre à quoi ressemblerait la fin du code |
|
| → |
Et aussi : le décryptage de Francis sur l’IA qui a testé l’Occident à l’aveugle, et vos réponses au sondage de la semaine dernière |
|
|
|
|
| |
 |
Le décryptage
Francis
CEO, Alegria Group
|
| Pendant sept jours, une IA sans nom a testé l’Occident à l’aveugle. Et ça a parfaitement marché. |
| Le 20 août, une ligne apparaît dans le catalogue d’OpenRouter, la place de marché que des centaines de milliers de développeurs consultent pour choisir quel modèle brancher dans leurs outils. Un nom que personne ne connaît, Ox Alpha. À la place du fabricant, un seul mot : stealth. Prix affiché : zéro.
Sept jours plus tard, ce modèle sans identité est devenu le plus utilisé de toute la plateforme. 503 000 personnes l’ont adopté sans savoir qui l’avait construit. Le patron de Stripe, qui vient de racheter OpenRouter, le félicite publiquement. La presse tech mondiale en fait ses gros titres. Et pendant sept jours entiers, personne ne dit à qui appartient ce modèle.
La seule donnée publique pendant cette semaine : l’opérateur mystérieux offre 100 000 milliards de tokens par jour, gratuitement. Tout le monde a lu ce chiffre comme un cadeau. Presque personne ne s’est demandé pourquoi un laboratoire brûle une somme pareille pour des inconnus.
Au septième jour, ils se dénoncent eux-mêmes. Et leur communiqué contient une phrase que je n’avais jamais lue chez un industriel : « avant la sortie, nous avons testé ce modèle anonymement pour récolter des retours d’utilisateurs ». Ils avouent le dispositif. Ils ne disent pas pourquoi ils en avaient besoin.
Un laboratoire dépense des centaines de millions pour entraîner un modèle, l’offre à un demi-million de personnes, et refuse d’y mettre son nom au moment précis où il aurait dû le crier sur tous les toits. Cette semaine-là a mesuré nos réflexes à nous, en Occident, et le résultat leur a donné exactement la réponse qu’ils cherchaient.
C’est un test grandeur réelle, mené sur les développeurs et les utilisateurs occidentaux sans qu’aucun d’eux ne le sache, et mené de main de maître. Ce qu’il prépare pour les prochains mois pèse beaucoup plus lourd qu’un modèle de plus dans un catalogue. J’ai remonté ces sept jours un par un dans la vidéo : ce qu’ils ont réellement acheté avec ces tokens offerts, comment la communauté a fini par les démasquer, et le détail que je n’ai vu relever nulle part en France, celui qui change toute la lecture de cette histoire pour l’Europe. |
|
|
|
| |
| Les signaux de la semaine |
| 01 |
Les deux détails qui rendent enfin les agents IA utilisables au quotidien |
|
| Où on en est. Les agents IA sont sortis de la démonstration. ChatGPT Work est arrivé mi-juillet, Claude Cowork existe depuis plusieurs mois, et beaucoup de monde s’en sert déjà chaque semaine pour faire faire du travail, plus seulement pour poser des questions. Il restait deux points de blocage très concrets. Les deux viennent de tomber la même semaine. |
| Ce qui a été annoncé. ChatGPT Work sait maintenant se connecter tout seul à des sites web et mobiles, sans jamais voir votre identifiant ni votre mot de passe. Prise de rendez-vous, vérification d’un remboursement chez votre mutuelle, ouverture de compteurs pour un déménagement, dépôt de factures dans votre outil de comptabilité : la liste de cas donnée par OpenAI est très terre à terre. De son côté, Anthropic a sorti un navigateur intégré directement dans Claude Cowork. Plus besoin de l’extension Chrome : l’agent navigue dans un panneau séparé de l’application, sans vos onglets, sans votre historique et sans vos mots de passe enregistrés. Et quand un site le bloque parce qu’il faut être connecté, vous pouvez lui importer vos cookies et vos mots de passe, site par site, au moment où vous en avez besoin. |
| Pourquoi ces détails changent tout à l’usage. Sur le papier, une histoire de connexion et un navigateur en plus, ça paraît futile. À l’usage, c’est exactement ce qui faisait échouer une mission sur deux. L’agent avançait bien, arrivait sur une page de connexion, et s’arrêtait là : vous récupériez un travail à moitié fait, au moment précis où vous étiez parti faire autre chose. Le navigateur isolé règle l’autre gêne. Laisser un agent cliquer dans votre propre Chrome, avec toutes vos sessions ouvertes et votre historique, ça bloque, et vous ne pouvez pas vous servir du navigateur en même temps que lui. Là, il travaille dans son coin pendant que vous continuez sur votre écran, et vous lui ouvrez l’accès à un site précis seulement quand la mission le demande. |
| |
Ce que vous faites lundi. Une mission, un dossier, un objectif. Créez un dossier dédié sur votre ordinateur, mettez-y uniquement les fichiers de la tâche, donnez cet accès à l’agent, décrivez la mission en français normal (le contexte, le résultat attendu, la forme), validez le plan qu’il vous propose, puis ajustez au lieu de tout recommencer. C’est la méthode qu’on déroule pas à pas dans la vidéo juste en dessous, et elle marche à l’identique sur ChatGPT Work et sur Claude Cowork. |
|
| Le point de vigilance. Un agent qui navigue peut tomber sur une page piégée, une instruction cachée dans le contenu, conçue pour le détourner de sa mission. Anthropic le reconnaît sans détour : ses garde-fous réduisent ce risque, ils ne l’éliminent pas. Commencez par des sites de confiance, et gardez la validation finale sur tout ce qui touche à de l’argent. Deuxième réserve, plus prosaïque : une grosse mission consomme beaucoup plus de votre forfait qu’une question dans le chat. Regardez votre consommation restante avant de lancer dix tâches planifiées d’un coup. |
| Lire l’actu en détail → |
|
|
|
|
| 02 |
Trois nouveaux modèles sortent la même semaine, tous ne méritent pas votre temps |
|
| D’où ça vient. Trois modèles sont sortis à deux jours d’écart : Claude Fable 5.1 et Mythos 5.1 le 1er septembre, Gemini 3.8 Flash le lendemain, troisième version Flash de Google en six semaines. Difficile de suivre, encore plus difficile de savoir lequel change quelque chose pour vous. |
| Ce qui a été annoncé. Fable 5.1 est la version grand public du nouveau modèle d’Anthropic, avec les protections de sécurité standard. Mythos 5.1 vise les organisations de cybersécurité et de sciences du vivant, en accès restreint. Le prix d’entrée et de sortie ne bouge pas, mais la lecture du cache, le fait de réutiliser du contexte déjà envoyé au modèle, coûte 75 % de moins, jusqu’à 45 % d’économie sur des missions d’agent qui tournent plusieurs heures. Gemini 3.8 Flash, de son côté, raisonne davantage avant de répondre et utilise ses outils de façon plus itérative, ce qui améliore ses résultats sur du code et des tâches complexes, au prix d’une consommation plus élevée. Une version Cyber, réservée à un programme d’accès restreint pour gouvernements et infrastructures critiques, cherche activement des failles de sécurité. |
| Ce qui est utile là-dedans. Si vous utilisez déjà Claude pour des tâches longues, un agent qui enchaîne plusieurs actions ou une recherche approfondie, la baisse du coût de cache se voit directement sur la facture, sans rien changer à votre façon de travailler. Gemini 3.8 Flash n’a d’intérêt que si vos usages touchent au code ou à des tâches à plusieurs étapes : pour de la rédaction ou des réponses courtes, la version précédente suffit et consomme moins. La déclinaison Cyber ne concerne, à ce stade, quasiment personne parmi les lecteurs de cette newsletter. |
| |
Ce que vous faites lundi. Ne changez pas d’outil sous prétexte qu’un nouveau modèle est sorti. Vérifiez juste un point : le tarif de Gemini 3.8 Flash double au 1er janvier 2027, de 0,75 $ à 1,50 $ le million de tokens en entrée. Si vous aviez prévu de tester cet outil, c’est le moment, pas dans quatre mois. |
|
| Lire l’actu en détail → |
|
|
| 03 |
L’interface qui se génère à la volée : Runway montre à quoi ressemblerait la fin du code |
|
| La situation. Un outil de programmation IA écrit du code, et c’est ensuite votre navigateur qui transforme ce code en boutons et en écrans. Runway, connu pour ses IA de génération vidéo, vient de supprimer cette étape entièrement. |
| Les chiffres. Solaris, le premier « modèle d’interface » de Runway, construit sur son moteur vidéo Gen-4.5, génère l’écran lui-même, image par image, à chaque clic et à chaque glissement. Il prédit à quoi doit ressembler l’écran suivant, et aucune ligne de code n’est produite au passage. Runway avance un chiffre : sur un panel de 250 évaluateurs, ses interfaces ont été préférées à celles codées par Claude Opus 5 dans 61 % des cas sur le respect des consignes, et 71 % sur le comportement naturel de l’interface. L’accès reste pour l’instant sur demande. |
| Pourquoi c’est peut-être le futur de l’interface. Depuis soixante ans, un logiciel c’est du code qu’une machine exécute, et un écran c’est le résultat visible de ce code. Là, le modèle devient le logiciel, et l’écran est ce qu’il imagine à l’instant où vous cliquez. Poussé au bout, plus personne n’écrit d’interface, ni à la main ni en no-code : on la décrit, et elle existe. Ce que ça remet en question dépasse largement le métier de développeur, parce que les bibliothèques de composants, les gabarits, les outils no-code, tout ce qui a été construit pour rendre du code réutilisable perd son intérêt si l’écran se fabrique à la demande. Ma réserve : entre une démonstration qui impressionne et un outil qui tient une journée de travail réelle, il y a souvent deux ou trois ans. Un bouton doit encore faire la même chose cinq clics plus tard, et l’accessibilité, la sauvegarde d’un état ou la reprise après une erreur doivent fonctionner à chaque fois. |
| |
Ce que vous faites lundi. Rien à changer cette semaine, l’accès est fermé. En revanche, si vous vendez des sites, des applications ou des automatisations no-code, posez-vous la question maintenant plutôt que dans un an : le jour où fabriquer une interface ne coûte plus rien, ce que vous vendez devient la compréhension du besoin, la donnée, et le fait que le résultat soit branché au reste des outils du client. Commencez à déplacer votre discours commercial de ce côté-là, c’est vrai quelle que soit la technologie qui gagne. |
|
| Lire l’actu en détail → |
|
| |
| En bref |
| L’actu qui compte, mais qui tient en trois lignes. |
| 🧠 |
OpenAI fait raisonner son prochain modèle d’une façon que plus personne ne peut lire. Astra, le futur modèle d’OpenAI, utilise une technique qui repasse plusieurs fois sur la même question en interne au lieu de dérouler des étapes lisibles. On voit donc beaucoup moins ce qui se passe dans sa tête, et plusieurs chercheurs en sécurité s’en inquiètent publiquement. Rien d’actionnable pour vous cette semaine, mais c’est le genre de choix technique dont on reparlera longtemps. Voir |
|
| 🐙 |
OpenClaw sort sa plus grosse mise à jour, portée par 933 contributeurs. Plus de 16 000 modifications de code, soit environ la moitié de tout ce qui a été intégré au projet depuis son lancement : installation simplifiée qui récupère vos abonnements existants, application navigateur repensée, et des sessions partagées où plusieurs personnes travaillent avec le même assistant. Le tout open source et gratuit. Voir |
|
| ☁️ |
Salesforce met Claude dans son CRM, et ses résultats rassurent sur l’avenir du logiciel d’entreprise. 11,3 milliards de dollars de chiffre d’affaires sur le trimestre, en hausse de 11 %, et le lancement de Claudeforce : un module qui permet d’interroger ses données Salesforce directement depuis Claude, avec 37 compétences prêtes à l’emploi, en bêta ouverte ce mois-ci. L’apocalypse du SaaS annoncée depuis deux ans attendra : bien intégrée, l’IA devient un relais de croissance pour ces plateformes. Voir |
|
|
| |
| Le bruit qu’on a ignoré |
| 💾 |
Anthropic a signé 35 milliards de dollars de cloud avec Lambda pour sécuriser sa puissance de calcul. En tant qu’utilisateur, ça ne change rien à votre quotidien. La seule leçon à retenir : la bataille de l’IA ne se joue plus sur la qualité des modèles, elle se joue sur qui a réservé assez de puces pour tenir la cadence. Voir |
|
| 🇫🇷 |
Nvidia rachèterait Hugging Face, la plateforme qui héberge des millions de modèles IA, pour 12,9 milliards de dollars. Ça concerne surtout les développeurs, rien ne change radicalement pour vous. Le seul regret : encore une pépite française qui repasse sous pavillon américain. Voir |
|
| 🎨 |
Google lance Pics, son concurrent de Canva intégré à Workspace. Le déploiement démarre chez les abonnés Google AI Pro et Ultra et les clients professionnels, donc tout le monde n’y a pas accès. Et générer un visuel à partir d’une consigne, les autres outils le font déjà. Voir |
|
|
| |
| Le sondage |
| Utiliseriez-vous une IA sans savoir qui l’a fabriquée, si elle est gratuite et parmi les meilleures du monde ? |
|
|
| Un clic pour voter, puis une phrase pour dire pourquoi sur la page qui suit. C’est cette phrase que je lis, et je publie les meilleures la semaine prochaine, y compris celles qui me contredisent. |
|
| |
| Vous avez répondu |
| La semaine dernière, on vous demandait si vous accepteriez qu’un agent IA fasse des achats à votre place, sans validation, jusqu’à un certain montant. |
|
|
|
|
| 1 106 votes et 30 commentaires. Ce qui revient le plus dans vos réponses : la réserve porte sur l’argent et sur la décision, pas sur l’IA elle-même. |
| |
« Parce que je fais entièrement confiance à l’IA. » Christophe · a voté Je délègue |
|
| |
« Parce que je gagne plus de temps. » Eyden · a voté Je délègue |
|
| |
« Je m’occuperais d’autre chose. » Abdel · a voté Je délègue |
|
| |
« Je garde la main pour garder le contact avec la réalité. Avoir un mot gentil avec la caissière, ou offrir quelque chose à ceux qui sont assis dehors. » Michel · a voté Je garde la main |
|
| |
« Les achats, c’est la personnalité et le choix. Imaginez que l’IA choisisse la maison pour moi. Une aide oui, une délégation non. Même pour un kilo de tomates ou une assurance. » Véronique · a voté Je garde la main |
|
| |
« Mes sous, mes décisions. » GzG · a voté Je garde la main |
|
|
| |
| Si vous ne retenez qu’une chose de cette rentrée : pendant que douze modèles se battaient pour votre attention, un laboratoire chinois a prouvé tranquillement qu’il pouvait servir un modèle de haut niveau à un demi-million d’occidentaux sur ses propres puces. Le décryptage de Francis, en haut de cet email, raconte comment.
Votez au sondage, une phrase suffit pour expliquer votre choix. Vos réponses de la semaine dernière sont juste au-dessus, et elles étaient très tranchées.
Bonne fin de semaine ! |
 |
Alexandre
SIGNAL, la newsletter d’Alegria Group
|
|
| PS. Répondez à cet email si un sujet mérite qu’on y revienne plus en détail la semaine prochaine, je lis chaque réponse. |
|
| |
|
|
|
|
| Alegria Group · 2-4 rue Mozart, 92120 Clichy, France |
Vous recevez SIGNAL parce que vous vous y êtes abonné. Se désabonner · Gérer mes préférences |
|
|