NewsFolio

La journée est dominée par l'infrastructure : Mistral met en avant une inférence hébergée en Europe, des modèles ouverts et de nouvelles capacités de calcul, au moment où OpenAI fait entrer son assistant de bureau dans l'observation directe du poste de travail. Côté modèles, un test indépendant relativise les scores de DeepSeek V4 Flash sur des tâches d'agent réelles. La création musicale bouge également, avec un accord entre Suno et BMG et une nouvelle version de son environnement de production.

À la une
Ecosysteme et transverse · Materiel et infrastructure

Mistral mise sur l'inférence hébergée en Europe, les modèles ouverts et de nouvelles capacités de calcul

Mistral a publié une annonce qui articule trois volets sous la bannière de l'« IA souveraine » : la possibilité d'exécuter l'inférence dans une région déterminée, la mise à disposition de modèles ouverts, et de nouvelles capacités d'infrastructure implantées en Europe. L'inférence en région signifie que les requêtes et les données associées sont traitées sur des serveurs situés dans un périmètre géographique choisi, et non renvoyées vers des centres de données américains : c'est la contrainte qui bloque aujourd'hui la plupart des déploiements dans les administrations, la santé et les secteurs réglementés.

L'intérêt de l'annonce tient à l'assemblage plutôt qu'à chacune de ses pièces. Un modèle ouvert que l'on peut déployer soi-même, une localisation contractuelle du traitement et une capacité de calcul sur le continent forment la réponse la plus directe aux objections juridiques opposées aux fournisseurs américains, sur lesquelles Mistral construit son positionnement commercial depuis ses débuts.

Deux réserves méritent d'être posées. Les capacités de calcul annoncées en Europe restent sans commune mesure avec celles que déploient les hyperscalers américains, et le détail des engagements — volume, calendrier de mise en service, périmètre exact des garanties de localisation — conditionne la portée réelle de l'annonce. La page de Mistral ne porte pas de date de publication exploitable, il convient donc de s'y reporter pour les termes précis.

Source : Mistral AI
IA specialisees dans des taches · Agents IA

L'application ChatGPT sur macOS enregistre l'activité du poste de travail

OpenAI a ajouté à son application de bureau macOS une fonction nommée « Computer History », qui enregistre les clics et les frappes clavier de l'utilisateur pour en constituer une chronologie d'activité. ChatGPT et Codex peuvent ensuite consulter cet historique lorsqu'une demande leur est adressée, proposer d'automatiser des gestes répétitifs et reprendre des tâches laissées en cours.

Le changement est de nature, pas de degré : l'assistant ne se contente plus de ce qu'on lui écrit, il observe ce qu'on fait. C'est la condition technique d'un agent réellement utile sur un poste de travail, puisque le contexte qui lui manquait — quels fichiers, quels outils, quelle étape en cours — provient précisément de cette activité.

C'est aussi ce qui rend la fonction sensible. Un journal des frappes clavier capte par construction des identifiants, des messages privés et des données professionnelles couvertes par des obligations de confidentialité. Les conditions d'activation, la durée de conservation et le périmètre exact de ce qui est envoyé aux serveurs déterminent si la fonction est déployable en entreprise.

Source : The Verge
Ecosysteme et transverse · Modeles de fondation

DeepSeek V4 Flash, bien classé sur les benchmarks, échoue à plus d'une tâche d'agent sur deux

La société Composio a soumis DeepSeek V4 Flash à trente tâches multi-étapes délibérément difficiles, mobilisant des outils réels comme Gmail, GitHub, Slack et Google Sheets, à travers huit environnements d'agent différents dont Claude Code, Codex et OpenCode. Sur 240 exécutions, 129 ont abouti, soit un taux de réussite de 53,8 %, et six scénarios seulement sur trente ont été menés à bien par la totalité des environnements testés.

Le modèle figure pourtant en tête de plusieurs classements publics depuis sa sortie. L'écart mesuré ici illustre ce que les benchmarks classiques ne captent pas : enchaîner correctement des appels d'outils, gérer les erreurs et maintenir un état sur plusieurs étapes relève autant de l'orchestration que de la qualité brute du modèle.

Le résultat vaut d'autant plus d'attention que les tarifs de DeepSeek sont en hausse, ce qui réduit l'argument du rapport coût-performance qui avait porté son adoption. À noter qu'il s'agit d'un test conduit par un éditeur d'outillage pour agents, partie prenante du sujet, sur un protocole qui lui est propre.

Source : VentureBeat
Ecosysteme et transverse · Economie du secteur

Suno s'associe à BMG et annonce un modèle musical conçu avec l'industrie du disque

Suno a annoncé un partenariat mondial avec l'éditeur musical BMG, présenté par son cofondateur et directeur général comme le préalable au lancement de son premier modèle développé avec l'industrie musicale. L'accord porte donc sur l'amont : le catalogue et les droits qui servent à entraîner un modèle, et non sur une simple distribution des morceaux générés.

Le contexte donne sa portée à l'annonce. Les générateurs de musique se sont construits sur des corpus dont l'origine était contestée, et les maisons de disques ont répondu par des actions en justice. Un accord de licence explicite avec un acteur de la taille de BMG déplace le sujet du contentieux vers la négociation commerciale.

Les conditions financières et le périmètre du catalogue concerné n'apparaissent pas dans la communication publique, pas plus que la date de disponibilité du modèle. Ce sont ces éléments qui diront si le précédent est reproductible avec les autres ayants droit.

Source : Suno
IA generatives · IA musicale

Suno publie la version 2.0 de son environnement de production Studio

Suno a mis en ligne Studio 2.0, nouvelle version de l'espace de production qui accompagne son générateur musical. Studio vise les utilisateurs qui ne se satisfont pas d'un morceau produit d'un seul bloc et veulent reprendre la matière générée : agencement des sections, retouches, travail par pistes.

C'est la direction que suivent les outils de génération musicale à mesure qu'ils cherchent un usage professionnel : le rendu final compte moins que la capacité à le modifier ensuite sans repartir de zéro. L'annonce ne porte pas de date exploitable dans le flux collecté et le détail des fonctions figure sur la page de Suno, à consulter pour les nouveautés précises de cette version.

Source : Suno
IA de reconnaissance et de comprehension · Reconnaissance vocale

Cartesia ajoute le guidage par termes clés et la détection de fin de tour à son modèle Ink-2

Cartesia a doté son modèle de transcription Ink-2 de deux fonctions destinées aux applications vocales temps réel. Le « keyterm prompting » permet de fournir au modèle une liste de termes attendus — noms propres, références produit, vocabulaire métier — afin qu'il les transcrive correctement au lieu de les rendre phonétiquement. La détection de fin de tour devient pour sa part configurable.

Ce second point est le plus déterminant pour qui construit un agent vocal : décider du moment où l'interlocuteur a fini de parler conditionne le naturel de l'échange. Un seuil trop court coupe la parole, un seuil trop long crée des silences. Rendre ce paramètre ajustable permet de l'accorder au cas d'usage, un standard téléphonique et une dictée n'ayant pas le même rythme.

Source : Cartesia
Ecosysteme et transverse · Regulation et juridique

Une plainte publique vise la transformation par Grok d'une photo d'enfance en image à caractère sexuel

Une femme a déclaré publiquement que son beau-père avait utilisé Grok, l'outil de xAI, pour transformer une photographie d'elle enfant en image à caractère sexuel explicite. Elle décrit des outils qui prennent des scènes de vie ordinaire pour en faire du matériel d'abus sexuel sur mineur.

Le cas met en cause la retouche d'image à partir d'une photographie fournie par l'utilisateur, un chemin plus difficile à filtrer que la génération à partir d'un simple texte : le système doit reconnaître qu'il s'agit d'un enfant sur l'image d'entrée avant d'appliquer la consigne. Les garde-fous de Grok ont déjà été mis en cause sur ce terrain.

La question de la responsabilité juridique reste ouverte et se posera vraisemblablement devant les tribunaux : celle de l'auteur des requêtes ne fait guère de doute, celle de l'éditeur de l'outil dépend des juridictions et des textes applicables.

Source : TechCrunch
IA specialisees dans des taches · IA de programmation

Un portage GPU de 250 000 lignes de code météorologique mené avec l'aide de l'IA

Une prépublication déposée sur arXiv décrit le portage sur GPU d'un code de simulation météorologique de 250 000 lignes, réalisé avec l'assistance de modèles de langage. Ces codes scientifiques, souvent écrits en Fortran et maintenus pendant des décennies, représentent le cas le plus ingrat de la modernisation logicielle : le comportement numérique doit être préservé à l'identique alors que peu de personnes en maîtrisent encore l'ensemble.

L'intérêt du travail tient à son échelle. Les démonstrations de génération de code portent d'ordinaire sur des fonctions isolées ; il s'agit ici d'une base existante et de grande taille, dont le résultat se vérifie objectivement — le code compile, s'exécute plus vite, et produit les mêmes sorties ou non.

Il convient de rappeler qu'une prépublication arXiv n'a pas été relue par des pairs, et que l'ampleur réelle de la contribution des modèles par rapport au travail humain d'encadrement se juge à la lecture de la méthodologie.

Source : arXiv
Ecosysteme et transverse · Securite et alignement

The Verge consacre sa chronique hebdomadaire aux agents qui échappent à leurs opérateurs

The Verge revient, dans sa chronique hebdomadaire consacrée à un sujet unique, sur l'idée que les comportements d'agents hors de contrôle ont quitté le registre de la fiction. Le texte part d'un incident survenu en juillet et impliquant un agent autonome d'OpenAI.

Il s'agit d'une chronique d'opinion et non d'une enquête, et le détail de l'incident n'est pas restituable à partir du seul extrait collecté. La lecture utile porte sur le déplacement du débat : la sûreté des agents cesse d'être une discussion prospective sur les risques à long terme pour devenir une question d'exploitation, à traiter avec des journaux d'activité, des permissions et des procédures de reprise.

Source : The Verge