BLOG
Shiwen Dialogue – Épisode 17|Confession d'un ingénieur de DeepSeek : celui qui a accéléré l'IA de ses propres mains s'est condamné lui-même à six mois avec sursis
Ouverture : un long article de trois mille caractères, et un homme qui écrit lui-même son propre éloge funèbre
Au petit matin du 14 septembre, Liu Shengyu, ingénieur des systèmes de machine learning chez DeepSeek, a publié un long article d’environ trois mille caractères dont le titre tient en une seule phrase : « J’ai dû enterrer mon talent dans l’hier ». Il est le responsable du principal opérateur d’Attention de DeepSeek V4.1 — pour le dire plus franchement, si ce modèle tourne aussi vite, une part de cette vitesse, c’est lui qui l’a écrite de ses propres mains. Moins de deux jours après sa parution, à partir du 15 septembre, l’article a déferlé sur les écrans en Chine comme à l’étranger : Zhihu a mis en ligne une question de discussion « Que penser du “J’ai dû enterrer mon talent dans l’hier” de Liu Shengyu ? », et les médias tech ont enchaîné les articles les uns après les autres.
Un homme qui accélère l’AI de ses propres mains vient d’écrire, de cette même main, son propre éloge funèbre. La formule sonne comme un titre racoleur, mais le constat central de son article est formulé avec beaucoup de sang-froid : dans les six mois à un an à venir, le niveau de l’AI en matière d’écriture d’opérateurs rattrapera le sien, voire le dépassera.
Shiwen : Un ingénieur de tout premier plan déclare publiquement que son talent est sur le point de devenir obsolète — quelle a été votre première réaction ?
Yongliang : J’ai d’abord vérifié une chose — ce n’est ni la rancune d’un homme qui vient d’être licencié, ni une opération de buzz. En observant ce qu’il fait chaque jour, il a déduit, étape par étape, son propre point d’arrivée. Ce cheminement déductif mérite bien plus d’être écouté que dix mille articles du genre « l’AI va-t-elle remplacer les programmeurs ».
Shiwen : Alors parlons-en à fond : qu’a écrit exactement ce long article, pourquoi ses propos méritent plus d’attention que l’anxiété ordinaire face à l’AI, combien de couches reste-t-il aux douves du talent, et comment faut-il vraiment lire la métaphore qui suscite le plus de controverse.
Q1 : Commençons par le point de départ — quel genre d’article peut devenir viral à ce point ?
Yongliang : Trois éléments se superposent : celui qui tient ces propos a un profil suffisamment solide, ses propos sont suffisamment durs, et le moment est suffisamment bien choisi.
Parlons d’abord de la personne. Liu Shengyu est le responsable de l’opérateur Attention principal de DeepSeek V4.1. L’opérateur est le point vital de la vitesse d’inférence d’un modèle, et ceux qui sont capables de travailler à ce poste se comptent sur les doigts de la main dans l’industrie. Ce genre de personne n’accorde normalement pas d’interviews et ne s’exprime pas en public ; dès qu’il ouvre la bouche, c’est pour écrire trois mille caractères d’éloge funèbre de lui-même — ce contraste fait à lui seul une actualité. Parlons ensuite des propos. Il ne se plaint ni de l’entreprise, ni du secteur : tout le texte est l’adieu d’un ingénieur à son propre savoir-faire — selon la version rapportée par les médias, il a dit : « Je n’irai pas jusqu’au chômage, mais je dois absolument me reconvertir ». Les adieux, ce n’est pas ce qui est rare ; ce qui est rare, c’est de prendre congé avec une telle lucidité, quitte à fournir même un calendrier : de six mois à un an. Enfin, le moment. Le feu de l’AI qui écrit du code consume le débat depuis plus d’un an, mais il n’a jamais brûlé que les programmeurs de la couche applicative ; cette fois, les flammes ont atteint ceux qui accélèrent eux-mêmes les modèles — la flamme a bouclé un tour et revient brûler celui qui alimentait le feu.
Q2 : Qu’a-t-il réellement dit ? Que signifient le sursis de six mois, la reconversion et le « pilote de mecha » ?
Yongliang : Il a condamné ce savoir-faire à six mois de sursis, puis s’est déjà préparé sa prochaine étape : passer de celui qui écrit des kernels à celui qui pilote des Agents.
Le cœur de cet article long est une chronologie : il estime que d’ici six mois à un an, le niveau de l’IA en écriture de kernels rattrapera, voire dépassera le sien. Le travail sur les kernels était autrefois l’artisanat d’une petite élite parmi les ingénieurs en puces et les ingénieurs en modèles — faire tourner les multiplications matricielles plus vite dans une mémoire vidéo et une enveloppe énergétique limitées reposait sur une intuition accumulée au fil de longues années d’expérience. Lorsque celui qui exerce ce métier juge lui-même que l’IA atteindra ce niveau en six mois, le poids de ce signal n’a rien à voir avec celui de n’importe quel rapport sectoriel externe : c’est le diagnostic rédigé par le patient lui-même à l’approche de sa fin. Selon la transcription relayée par les médias, ses mots exacts étaient : « Je ne suis pas près de perdre mon emploi, mais je dois absolument me reconvertir », avec pour direction de passer de la conception, de l’écriture et de l’optimisation des kernels au rôle de « pilote de mecha » des Agents — un terme également issu de la transcription. L’idée est facile à comprendre : à l’avenir, la valeur ne résidera plus à fabriquer des pièces pour le mecha, mais à piloter le mecha. Le soir du 15 septembre, il a également répondu sur Zhihu à l’attention du public, ajoutant ainsi de ses propres mains du bois au feu de ce buzz qui inonde les écrans.
Q3 : Pourquoi l’anxiété d’un ingénieur de tout premier plan mérite-t-elle plus d’écoute que l’anxiété autour de l’AI clamée par les gens ordinaires ?
Yongliang : L’anxiété des gens ordinaires, c’est la peur de se faire renverser par une voiture ; la sienne, c’est de découvrir qu’il est en train d’installer le moteur de cette voiture — plus on est proche de la ligne d’arrivée, plus l’alerte a de la valeur.
J’ai passé dix-sept ans dans le logiciel et j’en ai vu, des gens qui criaient au loup. Mais avec Liu Sheng, c’est différent : c’est lui qui accélère l’AI de ses propres mains. Si l’AI écrit aujourd’hui des opérateurs, c’est précisément grâce à cette bande de gens — plus les modèles sont rapides, plus l’AI devient capable d’écrire du code et des opérateurs ; autrement dit, ils posent des pièces dans le moteur tout en regardant le compteur de vitesse grimper. Il ne devine donc pas la ligne d’arrivée : il lit le tableau de bord. Ce qui rend ce point de vue si rare, c’est que la grande majorité de ceux qui débattent du remplacement par l’AI fondent leur jugement sur leur ressenti ; lui, il le fonde sur chaque ligne de son travail quotidien. Plus remarquable encore, sa façon d’affronter cette anxiété — pas de gémissements, pas de blague sur une reconversion dans la livraison de repas, mais la mise en route immédiate pour se trouver sa prochaine place. 17 ans d’expérience à la tête d’une équipe m’ont appris que l’écart entre les gens ne tient généralement pas à celui qui voit le plus loin, mais à celui qui, une fois qu’il a vu, part le premier.
Q4 : Après dix-sept ans comme directeur technique, quand tu regardes en arrière — quelles couches du fossé du talent subsistent réellement ?
Yongliang : Ma réponse comporte trois couches : cette fois, il a vérifié de ses propres mains la vitesse à laquelle les deux premières tombent, mais personne n’a encore perdu la troisième.
La première couche est celle des outils : comment écrire du code, comment régler les opérateurs, comment utiliser les frameworks. Cette couche est en train d’être dévorée à une vitesse visible à l’œil nu, et le « sursis de six mois » de Liu Shengyu est précisément la sentence rendue contre elle. La deuxième couche est celle de la définition des problèmes : que veut réellement le client, où se trouve le véritable goulot d’étranglement du système, si cela vaut la peine d’être entrepris. L’IA sait résoudre des exercices, mais qui pose l’énoncé et pourquoi il faut le résoudre, cela reste à l’humain de le décider. La troisième couche est celle de la responsabilité : en cas d’incident, qui en porte la charge, qui signe pour les données médicales, qui tranche les décisions d’architecture. J’ai dirigé la technique d’un groupe hospitalier : des centaines de services JVM ; inscription des patients, paiement, analyses médicales — pas un seul ne devait s’arrêter ; à deux heures du matin, quand le système tombait en panne, l’IA ne décrochait pas le téléphone à ma place. C’est pourquoi je comprends le choix de Liu Shengyu de partir devenir « pilote de mecha » : ce n’est pas fuir la technique, c’est passer de la première couche, celle qui se fait dévorer, vers la deuxième et la troisième. La couche des outils sera lessivée, encore et encore, par des vagues technologiques successives ; la couche de la définition des problèmes et celle de la responsabilité sont, pour l’instant, encore entre les mains des humains. Mais attention : ce n’est vrai que pour l’instant — il ne s’est pas arrêté à cette couche, il se déplace vers une position plus proche du volant, et ce déplacement est en soi la réponse.
Q5 : Comment lire la métaphore la plus controversée — « pas moins grave que de laisser Hitler maîtriser la bombe atomique avant les Alliés » ?
Yongliang : Posons d’abord le cadre, avant de parler de l’interprétation. Ma lecture est la suivante : ce n’est pas une prise de position politique, c’est la crainte d’un ingénieur devant « l’avance définitive d’une entreprise, quelle qu’elle soit » — vous pouvez ne pas être d’accord avec lui, mais il vaut la peine de le comprendre.
Précisons d’abord le cadre : cette phrase provient de la réponse qu’il a publiée sur Zhihu le 15 septembre au soir ; des médias tels que Guancha.cn l’ont rapportée, et je ne cite ici que d’après ces rapports — il a déclaré : « Je ne crois pas qu’Anthropic ou OpenAI puissent faire cela ; je ne souhaite surtout pas qu’Anthropic détienne l’intelligence artificielle ou l’AGI la plus avancée et, pour exagérer à dessein, sa gravité n’est pas moindre que de laisser Hitler maîtriser la technologie de la bombe atomique avant les Alliés ». Dans cette même réponse figure une autre phrase, rapportée par les médias ainsi : « Devinez : si l’entreprise Anthropic détenait à jamais l’IA la plus avancée du monde, la société du futur deviendrait-elle communiste ou bien 2077 ? ». Je n’amplifie pas cette métaphore et je ne prends pas parti pour lui, mais deux points méritent d’être examinés. Premièrement, cela relève davantage du langage de conviction d’un ingénieur que du langage politique. Les ingénieurs croient que plus le pouvoir est grand, plus il exige de contrepoids ; ce qu’il craint, c’est « qu’une seule entreprise détienne à jamais l’IA la plus puissante », et non une entreprise concrète en particulier — si une autre entreprise venait à occuper cette place, sa crainte resterait très probablement inchangée. Deuxièmement, sa critique vise à la fois Anthropic et OpenAI, ce qui montre que ce qui compte à ses yeux, ce n’est pas le récit d’entreprise, mais le fait même d’une « avance unilatérale dénuée de contrepoids ». Cette inquiétude peut être débattue, mais le débat suppose d’abord d’admettre ceci : celui qui a poussé l’IA jusqu’à ce stade de ses propres mains a le droit de craindre qu’elle ne demeure entre les mains d’une seule personne. Il évoque aussi la question de l’éducation — il craint que les étudiants aient directement recours à l’IA pour accomplir leurs devoirs et leurs travaux pratiques, ce qui, à long terme, provoquerait une régression des compétences d’ingénierie (selon les propos rapportés par cryptocity). Cette phrase, en réalité, dit la même chose que la métaphore de la bombe atomique : plus encore que l’avance technologique, ce qui l’inquiète, c’est la disparition, au sein de la population, de la capacité à maîtriser la technique.
Épilogue
Shiwen : Pour terminer, résume cet épisode en une phrase ?
Yongliang : La peine de six mois avec sursis qu’il s’est infligée est en réalité un avertissement adressé à tous ceux qui vivent de leur savoir-faire — la durée de la peine est peut-être inexacte, mais le sursis, lui, est en train de toucher chacun d’entre nous.
Shiwen : Ces mots sont pour vous tous. Rendez-vous au prochain épisode.
【Plongée technique】Qu’est-ce qu’un opérateur ? Pourquoi le fait que « l’AI sache écrire des opérateurs » est-il si dévastateur ?
Le fil conducteur de ce numéro : « ceux qui accélèrent l’AI de leurs propres mains écrivent leur propre éloge funèbre ». Pour les lecteurs qui veulent creuser encore d’un cran, décortiquons une couche de plus : qu’est-ce qu’un opérateur, au juste, et pourquoi le signal de sa chute a-t-il une telle portée ?
Première couche : l’opérateur est le point vital de la vitesse des modèles. Quand un grand modèle tourne, il s’agit au fond d’opérations matricielles massives. L’opérateur, c’est l’implémentation concrète de ces opérations — pour un même calcul d’attention, la manière de l’écrire peut faire varier la vitesse de plusieurs fois sur une même puce. L’expérience d’un modèle est déterminée pour moitié par l’algorithme, et pour l’autre moitié par le savoir-faire des ingénieurs en opérateurs.
Deuxième couche : c’est un métier d’artisan à la plus haute densité d’expérience. Écrire des opérateurs exige de connaître à la fois le caractère des puces (bande passante de la mémoire vidéo, cache, unités parallèles) et la structure des modèles — il faut maîtriser les deux en profondeur. Ce type d’expérience était autrefois très difficile à acquérir en accéléré : c’est l’un des postes les plus emblématiques de la « barrière de talent ».
Troisième couche : c’est pourquoi « rattraper en six mois » est si dur à entendre. Si même l’artisanat à la plus haute densité d’expérience n’a plus qu’une durée de conservation de six mois, alors pour les autres postes techniques bâtis sur l’accumulation d’expérience, cette durée de conservation ne pourra être que plus courte, jamais plus longue. Ce n’est pas de l’alarmisme : c’est l’estimation donnée par ceux qui, dans le secteur, s’y connaissent le mieux — un éloge funèbre, tout le monde peut en écrire un, mais il ne compte vraiment que lorsqu’on l’écrit pour soi-même.
Revenons au fil conducteur de ce numéro : le talent de la couche des outils se déprécie à un rythme accéléré, tandis que la dépréciation de la couche de définition des problèmes et de la couche de la responsabilité est bien plus lente. Vers quelle couche se déplacer ? Voilà la vraie question que ce long article laisse à chacun.
Sources d’information de ce numéro
- Entrée « Liu Shengyu » de Baidu Baike ; reportage de Tencent News du 2026-09-16 (identité et fonction concordantes dans les deux sources)
- Tencent News / Toutiao / TechWeb / Wenxuecity : publication du long article (au petit matin du 2026-09-14) et propagation virale qui a suivi (à partir du 2026-09-15)
- EET-China / TechWeb : formules rapportées « Je ne suis pas près de perdre mon emploi, mais je dois impérativement me reconvertir » et « pilote de mecha »
- Guancha.cn du 2026-09-16 et Tencent News : citations de la réponse publiée sur Zhihu (dont la métaphore hitlérienne et les propos sur le communisme/2077, tous des propos rapportés)
- x.com @J_Lingshan0909 : compte rendu de la réponse faite sur Zhihu dans la soirée du 9-15
- cryptocity : inquiétudes concernant les questions d’éducation (propos rapportés)
- Zhihu : question de discussion « Que penser de “Je dois enterrer mon talent dans l’hier” de Liu Shengyu ? »