NewsFolio

Journée dense côté modèles et infrastructure : GLM-5.3 arrive en API à un tarif agressif, Cerebras présente une nouvelle génération de machine et Nvidia tente de transformer la puissance de calcul en classe d'actifs financiers. En parallèle, OpenAI dit avoir volontairement ralenti certains développements pour renforcer ses garde-fous, et Google pousse ses outils d'étude à quelques jours de la rentrée.

À la une
Ecosysteme et transverse · Modeles de fondation

GLM-5.3, le modèle frontière chinois, ouvre son API à 1,4 / 4,4 dollars par million de tokens

La start-up chinoise z.ai rend son modèle GLM-5.3 accessible par API, une semaine après sa présentation. Le tarif annoncé — 1,4 dollar par million de tokens en entrée, 4,4 dollars en sortie — le place nettement sous les grilles des modèles frontière américains équivalents, ce qui en fait un candidat sérieux pour les usages agentiques à fort volume, où le coût par appel devient le facteur limitant.

Ce positionnement tarifaire compte davantage que les scores de benchmark pris isolément. Un modèle qui tient le rythme des meilleurs à un tiers du prix change le calcul économique des applications qui enchaînent des dizaines d'appels par tâche : assistants de code, pipelines de traitement documentaire, agents autonomes. C'est précisément le segment sur lequel les laboratoires américains ont bâti leurs revenus API.

z.ai indique vouloir publier les poids du modèle, sans avoir communiqué de date ni de licence précise. Tant que ces deux points restent en suspens, l'étiquette « open source » mérite d'être prise avec prudence : la disponibilité en API et la publication des poids sous licence permissive sont deux choses différentes. Les développeurs déjà abonnés au forfait GLM Coding Plan sont pour l'instant restreints au protocole compatible avec l'API Chat Completions d'OpenAI.

Un point demande vérification indépendante : le modèle aurait, selon les comptes rendus de son lancement, identifié une vulnérabilité jusque-là inconnue dans Cursor. Si elle se confirme, cette capacité offensive appliquée à du code de production alimentera le débat sur ce qu'il est raisonnable de publier en poids ouverts.

Source : VentureBeat · Aussi : Artificial Analysis
Ecosysteme et transverse · Securite et alignement

OpenAI dit avoir ralenti volontairement une partie de ses développements

OpenAI a indiqué mardi avoir freiné le rythme de certains travaux de développement le temps de renforcer sa sécurité et ses garde-fous, avec notamment une pause de deux semaines. La démarche est présentée comme volontaire, sans contrainte réglementaire ni incident public déclencheur clairement identifié.

Le geste détonne dans le contexte de l'entreprise : introduction en Bourse attendue, concurrence directe d'Anthropic, et pression croissante des modèles chinois et à poids ouverts qui rattrapent l'écart sur les tâches de codage et de raisonnement. Ralentir quand tous les signaux commerciaux poussent à accélérer est une décision qui demande justification.

Deux lectures coexistent, et rien ne permet aujourd'hui de trancher. La première prend l'annonce au mot : une entreprise qui internalise le coût de ses propres risques. La seconde y voit un positionnement à destination des régulateurs et des futurs investisseurs, à un moment où la crédibilité sur la sûreté devient un actif. La portée réelle dépendra de ce qui a effectivement été mis en pause, information qu'OpenAI n'a pas détaillée.

Source : The Verge
Ecosysteme et transverse · Materiel et infrastructure

Cerebras présente le CS-4, nouvelle génération de son calculateur à puce géante

Cerebras a dévoilé le CS-4, la nouvelle itération de son système bâti autour d'une puce à l'échelle du wafer plutôt que d'un assemblage de GPU. L'approche du constructeur consiste à loger l'ensemble du modèle dans la mémoire d'un unique composant, ce qui supprime une grande partie des allers-retours réseau qui plafonnent la vitesse d'inférence sur les grappes classiques.

L'enjeu commercial se situe sur la latence. Cerebras s'est construit une position de niche en servant des modèles à des débits de tokens que les architectures à base de GPU atteignent difficilement, un argument qui prend de la valeur à mesure que les agents enchaînent les appels séquentiels et que l'attente devient perceptible pour l'utilisateur.

Les caractéristiques chiffrées communiquées au lancement demandent à être confrontées à des mesures indépendantes avant d'en tirer des conclusions. Les comparatifs de constructeurs reposent souvent sur des configurations difficilement transposables aux conditions réelles d'exploitation.

Source : Cerebras
IA appliquees a des secteurs particuliers · IA educative

Google étend ses outils d'étude à Search et Gemini pour la rentrée

Google déploie une série de fonctions destinées aux élèves et étudiants, réparties entre son moteur de recherche et Gemini. Ce dernier reçoit un espace dédié qui regroupe la collecte de recherches dans un carnet d'étude, la génération de fiches de révision et la création de quiz d'entraînement. Les carnets acceptent désormais graphiques et images, et peuvent intégrer des dates d'examen.

Côté Search, l'entreprise ajoute des points d'entrée permettant de basculer une recherche vers ces outils de travail. L'objectif est explicite : faire de Gemini l'assistant par défaut du moment où un élève révise, face à un ChatGPT largement installé dans les usages étudiants.

La question pédagogique reste ouverte. Générer automatiquement des fiches et des quiz déplace une partie de l'effort de structuration — celui qui produit précisément l'ancrage mémoriel — de l'élève vers la machine. Aucun des acteurs n'a publié à ce jour de résultat d'apprentissage mesuré permettant d'évaluer ce que ces outils apportent ou coûtent réellement.

IA appliquees a des secteurs particuliers · IA commerciale et marketing

La publicité dans ChatGPT arrive dans 31 marchés européens

OpenAI étend son offre publicitaire ChatGPT Ads à 31 marchés européens. Les annonceurs peuvent y toucher les utilisateurs pendant qu'ils explorent un sujet, comparent des options ou préparent une décision d'achat — autrement dit au moment de l'intention, là où le référencement payant a bâti son modèle économique.

L'extension concerne directement les lecteurs francophones : la Belgique, la France et la Suisse figurent parmi les marchés européens visés par ce type de déploiement. Elle marque aussi la conversion d'un assistant conversationnel en support publicitaire à grande échelle, avec les questions que cela soulève sur la frontière entre réponse et placement.

Le cadre européen ajoute une contrainte que le marché américain n'impose pas. Le RGPD et le règlement sur les services numériques encadrent le ciblage et exigent l'identification claire du contenu commercial : la manière dont une publicité se distingue visuellement d'une réponse générée sera un point de vigilance pour les régulateurs comme pour les utilisateurs.

Source : OpenAI
Ecosysteme et transverse · Economie du secteur

Stripe absorbe OpenRouter, passage obligé de l'accès multi-modèles

OpenRouter annonce son rattachement à Stripe. Le service s'est imposé comme une couche d'intermédiation entre les développeurs et les fournisseurs de modèles : une seule clé, une seule facture, et la possibilité de basculer d'un modèle à l'autre sans réécrire son code — utile quand les prix et les performances bougent chaque mois.

Le rapprochement a une logique claire pour Stripe, dont le métier est l'infrastructure de paiement. Facturer à l'usage des appels de modèles, répartir les revenus entre fournisseurs et gérer la comptabilité analytique du token relèvent exactement de ses compétences, dans un secteur où la dépense API devient une ligne budgétaire majeure.

Les conditions financières de l'opération n'ont pas été communiquées. La question ouverte pour les utilisateurs porte sur la neutralité du routage : un agrégateur adossé à un acteur du paiement conserve-t-il le même intérêt à arbitrer objectivement entre fournisseurs concurrents ?

Source : OpenRouter
Ecosysteme et transverse · Economie du secteur

Nvidia et la finance veulent faire du calcul une classe d'actifs à 500 milliards de dollars

Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs et KKR travaillent avec Nvidia à un montage de financement de 500 milliards de dollars visant à traiter la puissance de calcul comme un actif financier à part entière. Le principe : adosser des instruments de dette et de titrisation à des parcs de GPU, sur le modèle de ce qui se pratique pour l'immobilier ou les infrastructures.

Le rapprochement mérite attention parce qu'il concerne un actif au comportement inhabituel. Un immeuble se déprécie lentement et garde une valeur résiduelle ; une génération de GPU perd l'essentiel de sa valeur d'usage dès que la suivante arrive, dans un cycle qui se compte en dizaines de mois et que le fabricant lui-même contrôle.

Cette asymétrie — le fournisseur du matériel participant à la structuration du financement qui permet de l'acheter — constitue le point sensible du dossier. Il faudra observer qui porte effectivement le risque de dépréciation, information que le montage n'a pas encore rendue publique.

Source : The Verge
IA specialisees dans des taches · IA conversationnelle

Meta AI sort une application Mac capable de lire l'écran

Meta lance une application macOS dédiée à son assistant conversationnel. La fonction distinctive est le partage de fenêtre : l'utilisateur donne à l'assistant l'accès visuel à une application ouverte, et celui-ci répond, suggère ou produit du contenu à partir de ce qu'il y voit. La dictée est prise en charge dans l'ensemble des applications du système.

Meta rejoint ainsi OpenAI, Anthropic et Google sur le poste de travail. L'enjeu est le même pour tous : quitter l'onglet de navigateur pour s'installer dans le flux de travail, là où l'assistant devient un réflexe plutôt qu'une destination.

La lecture d'écran suppose en contrepartie un accès à des contenus que l'utilisateur n'a pas explicitement soumis — documents ouverts, messagerie, informations professionnelles. Meta n'a pas détaillé ce qui est traité localement et ce qui remonte vers ses serveurs, ni la durée de conservation de ces captures.

Source : The Verge
Ecosysteme et transverse · Regulation et juridique

Meta a diffusé des publicités pour une application de déshabillage visant des femmes politiques

Meta a laissé passer sur ses plateformes des publicités pour une application promettant de générer des images dénudées de femmes politiques. L'une d'elles comportait une vidéo pornographique mettant en scène un deepfake ressemblant de près à une élue américaine.

Le problème n'est pas seulement l'existence de ces applications, largement documentée, mais leur promotion au sein d'un système publicitaire censé être modéré avant diffusion. Une publicité payante passe par un processus de validation : son acceptation traduit une défaillance de contrôle, pas un simple débordement de contenu utilisateur.

Le sujet se situe à l'intersection de plusieurs cadres juridiques qui se durcissent, notamment sur les images intimes non consenties et l'étiquetage des contenus synthétiques. Viser des personnalités politiques y ajoute une dimension d'intimidation ciblée que les dispositifs de modération automatique peinent manifestement à traiter.

Source : Ars Technica
Ecosysteme et transverse · Open source et outillage

Block ouvre le code de Berd, son atelier de travail avec des agents

Block, l'entreprise de Jack Dorsey qui détient Square, Cash App et Tidal, publie sous licence Apache 2.0 l'application Berd, conçue à l'origine pour ses propres équipes. Il s'agit d'un logiciel de bureau installé localement, et non d'un service en ligne, destiné à réunir dans un même environnement le travail avec des agents issus de modèles et d'outillages différents.

Deux choix techniques méritent d'être relevés. L'historique des conversations reste stocké sur la machine de l'utilisateur, ce qui écarte la dépendance à un service tiers pour des échanges qui contiennent souvent du code et des données internes. L'indépendance vis-à-vis du modèle sous-jacent évite par ailleurs de reconstruire l'outillage à chaque changement de fournisseur.

La licence Apache 2.0 autorise l'usage, la modification et la redistribution, y compris commerciale. Les binaires sont téléchargeables et le code est disponible sur GitHub. Reste à voir si Block maintiendra le projet au rythme d'un outil interne ou d'un produit communautaire — la différence se mesurera sur la réactivité aux contributions extérieures.

Source : VentureBeat