Brève IA : votre propre serveur d’IA n’est rentable que s’il travaille
Tôt ou tard, quelqu’un le dit : « Si on avait notre propre IA, nos données resteraient ici et on arrêterait de payer à l’usage. » Cette semaine, un vrai test de coûts met l’idée à l’épreuve, et deux mises à jour touchent les équipes qui gèrent déjà leurs outils d’IA. Voici ce qui a changé les 9 et 10 octobre, et quoi en faire.
Un vrai test de coûts : un GPU loué n’est rentable que s’il travaille
Le 10 octobre, le blogue Apps on Azure de Microsoft a publié le test d’une semaine mené par Wuyi Weng : le modèle ouvert Qwen3.8-27B sur un seul GPU H100 loué en mode Azure Spot, à prix réduit (environ 2 $ US l’heure). Pendant les trois heures les plus achalandées, le 9 octobre, il a traité 1 434 requêtes dont les jetons valaient 24,35 $ US au prix affiché d’une API publique, pour 4,65 $ US de machine. Sur la semaine, le portrait s’inverse : environ 46 heures de machine, installation, chargement du modèle et essais compris, ont coûté environ 98 $ US, plus les disques et le réseau, contre 86 $ US de jetons. Et ce prix a un revers : Azure a repris la machine sept fois en une quarantaine d’heures.
Pourquoi c’est important : selon l’auteur, ça paie quand c’est occupé. Avec environ 8 $ US de jetons par heure occupée contre 2 $ US de machine, le GPU doit travailler environ une heure sur quatre pour faire ses frais (notre calcul : 2 ÷ 8,12 = 0,25), soit à peu près 41 heures par semaine s’il est loué jour et nuit. Et ces heures-là étaient lourdes : environ 118 000 jetons d’entrée par requête, des documents entiers plutôt que des questions rapides. Selon le billet, l’hébergement maison est moins intéressant quand un trafic en rafales laisse le GPU inactif la majeure partie de la journée, comme dans la plupart des bureaux, occupés de 9 h à 17 h. Enfin, aucune région du test n’était canadienne : si le but est de garder vos données ici, prix et disponibilité dans une région canadienne sont une autre question.
Open WebUI 0.12 : une seule conversation pour l’équipe, la double authentification pour tous
Open WebUI, une interface de clavardage que les équipes hébergent elles-mêmes devant les modèles de leur choix, a publié sa version 0.12.0 le 10 octobre. Une conversation partagée peut maintenant passer de « Clone only » à « Allow replies » : les collègues continuent d’écrire dans la même conversation, chaque message indique qui l’a envoyé et chacun ne peut modifier ou régénérer que les siens. Les administrateurs peuvent aussi exiger une application d’authentification pour chaque utilisateur. La version comprend des correctifs de sécurité et de contrôle d’accès : le projet recommande de mettre à jour les installations en production.
Pourquoi c’est important : une passation, comme une soumission qu’une personne commence et qu’une autre termine, reste dans une seule conversation au lieu d’être recopiée ailleurs. Mais une interface hébergée chez vous n’est pas un modèle local : votre texte va là où roule le modèle choisi.
n8n bloque ses vieux nœuds de code, sauvegardes comprises
La version 2.42.6 de n8n, publiée le 9 octobre, refuse de créer ou de modifier un flux qui contient les nœuds obsolètes Function, Function Item et LangChain Code ; selon n8n, les deux premiers reposent encore sur un bac à sable qui n’est pas sécuritaire. Les flux enregistrés qui les contiennent directement continuent de fonctionner, et on peut toujours supprimer ou migrer ces nœuds. Les pièges : importer un flux qui n’est pas déjà sur l’instance échoue maintenant, y compris la restauration d’une sauvegarde dans une nouvelle instance, et ces nœuds cessent de fonctionner dans les outils de clavardage et dans les sous-flux chargés depuis du JSON, une URL ou un fichier. Un réglage, N8N_DEPRECATED_NODES_BLOCK=false, désactive la vérification.
Pourquoi c’est important : le jour où vous avez besoin d’une sauvegarde est le pire moment pour découvrir qu’elle ne s’importe plus.
Sources
Pour aller plus loin
- La politique IA d’une page que chaque petite équipe devrait écrire (gabarit gratuit)Votre équipe utilise déjà l’IA. Six règles sur une page (outils approuvés, feu de circulation pour les données, révision humaine, décisions sur des personnes, informer les clients, un responsable) et deux prompts pour la rédiger et la tester.Lire l’article
- Automatiser le traitement des factures avec l’IA, étape par étapeUn flux en cinq étapes pour une PME : une seule boîte pour les factures, une extraction par IA qui ne devine jamais, des règles simples pour la TPS, la TVQ et les doublons, une approbation humaine, puis votre logiciel comptable.Lire l’article
Combien vous coûtent ces tâches ?
Le calculateur estime en 2 minutes le temps et l’argent qu’une automatisation peut vous faire gagner.