BLOG

Shiwen-Dialog Folge 17|Bekenntnis eines DeepSeek-Ingenieurs: Wer mit eigener Hand der AI Beschleunigung verschafft hat, hat sich selbst zu einem halben Jahr auf Bewährung verurteilt

Kael Zhang
AIDeepSeekKarriere
广告 · Advertisement

Auftakt: Ein Artikel von 3000 Zeichen – und ein Mensch, der sich selbst den Nachruf schreibt

In den frühen Morgenstunden des 14. September veröffentlichte Liu Shengyu, Machine-Learning-Systems-Ingenieur bei DeepSeek, einen rund 3000 Zeichen langen Artikel, dessen Titel nur aus einem einzigen Satz bestand: „Ich musste mein Talent im Gestern begraben“. Er verantwortet den Haupt-Attention-Operator von DeepSeek V4.1 — salopp gesagt: Ein Teil dessen, wie schnell dieses Modell läuft, hat er eigenhändig hineingeschrieben. Weniger als zwei Tage nach Erscheinen ging der Artikel ab dem 15. September im In- und Ausland viral; auf Zhihu tauchte die Diskussionsfrage „Wie bewertet ihr Liu Shengyus ‚Ich musste mein Talent im Gestern begraben‘?“ auf, und Tech-Medien folgten mit Artikel um Artikel nach.

Jemand, der AI eigenhändig beschleunigt hat, hat sich eigenhändig den eigenen Nachruf geschrieben. Das klingt nach Clickbait, doch die zentrale Einschätzung in seinem Artikel ist nüchtern formuliert: Innerhalb der nächsten sechs Monate bis zu einem Jahr wird das Niveau, auf dem AI Operatoren schreibt, seines einholen oder sogar übertreffen.

Shiwen: Ein Top-Ingenieur sagt öffentlich, dass sein Talent veralten wird — was war deine erste Reaktion?

Yongliang: Zuerst habe ich eine Sache überprüft — er wettert nicht aus Frust über eine Entlassung, und es ist auch kein Hype. Er betrachtet die Arbeit, die er Tag für Tag verrichtet, und leitet daraus Schritt für Schritt seinen eigenen Endpunkt her. Dieser Herleitungsprozess ist es wert, gehört zu werden — mehr als zehntausend Artikel der Sorte „Wird AI die Programmierer ersetzen?“.

Shiwen: Dann reden wir eben alles durch: Was genau steht in diesem langen Artikel, warum ist das, was er sagt, hörenswerter als die AI-Angst gewöhnlicher Menschen, wie viele Schichten vom Burggraben des Talents noch übrig sind — und wie sollte man jene am stärksten umstrittene Metapher eigentlich lesen?

Q1: Zuerst der Anlass – was für ein Artikel kann derart viral gehen?

Yongliang: Drei Faktoren kommen zusammen: Wer das sagt, hat genug Gewicht; was gesagt wird, ist hart genug; und der Zeitpunkt ist geschickt genug.

Zuerst zur Person. Liu Shengyu ist der Verantwortliche für den Haupt-Attention-Operator von DeepSeek V4.1. Der Operator ist die Lebensader der Inferenzgeschwindigkeit eines Modells, und wer an dieser Stelle arbeiten kann, ist in der Branche an zwei Händen abzuzählen. Solche Leute geben normalerweise keine Interviews und äußern sich nicht öffentlich – und wenn sie den Mund aufmachen, dann gleich, um in 3000 Zeichen ihren eigenen Nachruf zu schreiben. Allein dieser Kontrast ist schon eine Nachricht. Dann die Worte. Er beklagt sich weder über das Unternehmen noch über die Branche; der gesamte Text ist der Abschied eines Ingenieurs von seinem eigenen Handwerk – in der Wiedergabe der Medien sagte er: „Ich werde zwar nicht unbedingt arbeitslos, aber ich muss zwingend den Beruf wechseln.“ Ein Abschied ist nichts Ungewöhnliches; ungewöhnlich ist, wie nüchtern er Abschied nimmt – er nennt sogar einen Zeitplan: ein halbes Jahr bis ein Jahr. Und schließlich der Zeitpunkt. Das Thema „AI schreibt Code“ brennt bereits seit über einem Jahr, aber bisher brannten immer nur die Programmierer auf der Anwendungsschicht; diesmal schlug die Flamme bei denen ein, die dem Modell höchstpersönlich Geschwindigkeit verleihen – das Feuer hat eine Runde gedreht und brennt nun zurück zu denen, die selbst Holz nachlegen.

Q2: Was hat er eigentlich gesagt? Was bedeuten das halbe Jahr Bewährung, der Berufswechsel und der „Mecha-Pilot“?

Yongliang: Er hat über dieses Handwerk eine Bewährungsstrafe von einem halben Jahr verhängt und sich zugleich schon die nächste Station gesucht: vom Menschen, der Operatoren schreibt, zum Menschen, der Agenten steuert.

Der Kern des langen Beitrags ist ein Zeitplan: Er ist überzeugt, dass AI innerhalb der nächsten sechs Monate bis zu einem Jahr beim Schreiben von Operatoren sein eigenes Niveau erreichen und sogar übertreffen wird. Die Arbeit an Operatoren war bisher das Handwerk einer kleinen Gruppe von Top-Leuten unter den Chip- und Modell-Ingenieuren — die Frage, wie man Matrixmultiplikation bei begrenztem Grafikspeicher und begrenztem Energieverbrauch schneller laufen lässt, beruht auf einer Intuition, die sich über viele Jahre Erfahrung angesammelt hat. Wenn jemand, der diese Arbeit selbst verrichtet, zu dem Urteil kommt, dass AI dieses Niveau binnen eines halben Jahres erreichen wird, dann hat dieses Signal ein ganz anderes Gewicht als jeder beliebige Branchenbericht von draußen: Das ist die Diagnose, die der todkranke Patient selbst ausstellt. Wie Medien wiedergaben, lautete sein ursprünglicher Wortlaut: „Ich werde zwar nicht arbeitslos, aber ich muss unbedingt den Beruf wechseln.“ Die Richtung führt weg vom Entwurf, vom Schreiben und von der Optimierung von Operatoren hin zum „Mecha-Piloten“ der Agenten — auch dieses Wort ist eine wiedergegebene Formulierung. Die Bedeutung ist nicht schwer zu verstehen: Der künftige Wert liegt nicht darin, Teile für den Mecha herzustellen, sondern darin, den Mecha zu pilotieren. Am Abend des 15. September äußerte er sich außerdem auf Zhihu zu der öffentlichen Aufmerksamkeit und goss damit persönlich noch einmal Öl ins Feuer dieser viralen Welle.

Q3: Warum ist die Angst eines Top-Ingenieurs wertvoller zu hören als das AI-Geschrei normaler Menschen?

Yongliang: Die Angst normaler Menschen ist die Angst, vom Auto überfahren zu werden; seine Angst ist die Entdeckung, dass er selbst gerade dabei ist, dem Auto den Motor einzubauen – je näher jemand dem Ziel kommt, desto wertvoller ist seine Warnung.

Ich arbeite seit siebzehn Jahren in der Softwarebranche und habe viel zu viele Leute erlebt, die „Der Wolf kommt!“ geschrien haben. Aber bei Liu Sheng ist das etwas anderes, denn er ist jemand, der AI mit eigener Hand beschleunigt. Dass AI Operatoren schreiben kann, ist genau das Werk dieser Leute selbst – je schneller die Modelle, desto stärker wird die Fähigkeit von AI, Code und Operatoren zu schreiben; sie bauen also mit der einen Hand Teile in den Motor ein und schauen mit der anderen zu, wie der Tachometer weiter nach oben klettert. Er rät also nicht, wo das Ziel liegt – er liest das Armaturenbrett. Das Seltene an dieser Perspektive liegt darin: Die allermeisten, die über die Ablösung durch AI reden, stützen ihr Urteil auf ihr Bauchgefühl; sein Urteil stützt sich auf jede einzelne Zeile seiner alltäglichen Arbeit. Noch wertvoller zu hören ist die Art, wie er mit der Angst umgeht – kein Wehklagen, kein Witz über den Quereinstieg als Essenslieferant, sondern er beginnt sofort, sich die nächste Position zu suchen. 17 Jahre Erfahrung in der Teamführung haben mir eines gezeigt: Der Unterschied zwischen Menschen liegt oft nicht darin, wer weiter vorausschaut, sondern darin, wer sich nach dem Hinschauen als Erster auf den Weg macht.

Q4: Nach siebzehn Jahren als Technischer Direktor – wenn du zurückblickst: Wie viele Schichten des Burggrabens des Talents sind eigentlich noch übrig?

Yongliang: Meine Antwort hat drei Schichten. Diesmal hat er höchstpersönlich erlebt, wie schnell die ersten beiden Schichten fallen – aber die dritte hat bislang noch niemand verloren.

Die erste Schicht ist die Werkzeugschicht: wie man Code schreibt, wie man Operatoren optimiert, wie man Frameworks benutzt. Diese Schicht wird gerade mit einer Geschwindigkeit aufgefressen, die man mit bloßem Auge verfolgen kann – Liu Shengyus „sechsmonatige Bewährungsstrafe” ist genau über diese Schicht verhängt worden. Die zweite Schicht ist die Schicht der Problemdefinition: Was wollen die Kunden wirklich? Wo liegt der eigentliche Engpass des Systems? Lohnt es sich, das Ganze überhaupt zu tun? AI kann Aufgaben lösen, aber wer die Aufgaben stellt und warum sie gelöst werden sollen – das müssen weiterhin Menschen entscheiden. Die dritte Schicht ist die Verantwortungsschicht: Wer haftet, wenn etwas schiefgeht? Wer unterschreibt medizinische Daten? Wer hat bei Architekturentscheidungen das letzte Wort? Ich habe die Technik eines Krankenhauskonzerns geführt – mehrere hundert JVM-Dienste, und Terminbuchung, Bezahlung, Labordiagnostik: keine davon durfte eine Minute stillstehen. Wenn das System um 2 Uhr nachts zusammenbricht, nimmt AI nicht für mich den Hörer ab. Deshalb kann ich nachvollziehen, dass Liu Shengyu sich entschlossen hat, „Mecha-Pilot” zu werden: Es ist keine Flucht aus der Technik, sondern ein Verschieben von der ersten Schicht, die gerade aufgefressen wird, hin zur zweiten und dritten. Die Werkzeugschicht wird von einer Technikwelle nach der anderen immer wieder weggespült; die Problemdefinitionsschicht und die Verantwortungsschicht liegen vorerst noch in der Hand der Menschen. Aber Achtung: Das gilt nur fürs Erste – er ist nicht auf dieser Schicht stehen geblieben, er rückt weiter näher ans Lenkrad, und genau diese Bewegung ist für sich genommen schon die Antwort.

Q5: Die am stärksten umstrittene Metapher – „nichts Geringeres, als hätte Hitler vor den Alliierten die Atombombe in der Hand” – wie ist sie zu lesen?

Yongliang: Erst die Faktenlage klären, dann über die Lesart sprechen. Meine Lesart ist: Das ist keine politische Stellungnahme, sondern die Angst eines Ingenieurs davor, dass „irgendein einzelnes Unternehmen für immer in Führung bleibt”. Ihr dürft ihm widersprechen, aber ihr solltet ihn erst einmal verstehen.

Zunächst zur Faktenlage: Dieser Satz stammt aus seiner Reaktion auf Zhihu am Abend des 15. September; Medien wie Guancha haben ihn sinngemäß wiedergegeben, und ich zitiere hier ausschließlich nach dieser Wiedergabe – er sagte: „Ich vertraue nicht darauf, dass Anthropic oder OpenAI so etwas tun können; ganz besonders wünsche ich nicht, dass Anthropic die fortschrittlichste künstliche Intelligenz oder AGI in Händen hält – zugespitzt gesagt, ist deren Tragweite nichts Geringeres, als hätte Hitler vor den Alliierten die Atombombentechnologie beherrscht.” In derselben Antwort fällt noch ein weiterer Satz, den Medien sinngemäß so wiedergaben: „Ratet mal: Wenn die Firma Anthropic für immer die fortschrittlichste KI der Welt in Händen hält – wird die Gesellschaft der Zukunft dann kommunistisch werden oder eben 2077?” Ich ziere diese Metapher nicht aus und ergreife auch nicht für ihn Partei, aber zwei Punkte lohnen es, auseinanderzunehmen. Erstens: Das ist eher die Glaubenssprache eines Ingenieurs als politische Sprache. Ingenieure glauben, dass je größer die Macht, desto nötiger die Gegengewichte; der Gegenstand seiner Angst ist „ein einzelnes Unternehmen, das für immer die stärkste KI in Händen hält”, und nicht ein konkretes Unternehmen an sich – säße ein anderes Unternehmen auf diesem Stuhl, bliebe seine Angst höchstwahrscheinlich dieselbe. Zweitens: Er richtet seine Spitze zugleich gegen Anthropic und OpenAI, was zeigt, dass ihm nicht die Erzählung eines Unternehmens wichtig ist, sondern die Sache „eine Alleinführung ohne Gegengewichte”. Über diese Sorge darf man streiten, aber die Voraussetzung des Streits ist zunächst einzugestehen: Ein Mensch, der die KI mit eigener Hand an diesen Punkt gebracht hat, hat das Recht, davor Angst zu haben, dass sie in der Hand einer einzelnen Person endet. Er spricht auch das Thema Bildung an – die Sorge, dass Studierende Hausaufgaben und Praxiskurse direkt mit KI erledigen und die ingenieurstechnischen Fähigkeiten auf Dauer verkümmern (sinngemäß wiedergegeben nach cryptocity). Dieser Satz bedeutet im Grunde dasselbe wie die Atombomben-Metapher: Was ihn mehr beunruhigt als der technologische Vorsprung, ist der Umstand, dass die Fähigkeit, mit Technik umzugehen, aus der Bevölkerung verschwindet.

Epilog

Shiwen: Zum Schluss: Fasse diese Folge in einem Satz zusammen?

Yongliang: Dass er sich selbst zu einem halben Jahr auf Bewährung verurteilt hat, ist eigentlich eine Mahnung an alle, die mit ihrem Handwerk ihr Geld verdienen — die Strafdauer mag nicht ganz stimmen, aber die Bewährung selbst ereignet sich gerade an jedem Einzelnen.

Shiwen: Dieser Satz sei euch allen mitgegeben. Bis zur nächsten Folge.


[Technischer Tiefgang] Was ist ein Operator? Warum „AI kann Operatoren schreiben” eine so verheerende Sprengkraft hat

Das Hauptthema dieser Folge lautet: „Wer mit eigener Hand AI beschleunigt, hat sich selbst den Nachruf geschrieben”. Für Leser, die noch eine Ebene tiefer gehen wollen, schlüssle ich hier eine Schicht weiter auf: Was ein Operator überhaupt ist – und warum sein Verlust als Signal von so großer Tragweite ist.

Erste Ebene: Operatoren sind die Lebensader der Modellgeschwindigkeit. Wenn ein großes Modell läuft, besteht es im Kern aus massenhaft Matrixoperationen. Operatoren sind die konkreten Implementierungen dieser Operationen – dieselbe Attention-Berechnung kann, je nachdem, wie sie geschrieben ist, auf demselben Chip um ein Vielfaches schneller oder langsamer sein. Das Erlebnis eines Modells wird zur einen Hälfte von den Algorithmen bestimmt, zur anderen Hälfte vom Handwerk der Operator-Ingenieure.

Zweite Ebene: Das ist Handwerk mit der höchsten Erfahrungsdichte. Wer Operatoren schreibt, muss zum einen die Eigenheiten der Chips verstehen (VRAM-Bandbreite, Cache, Paralleleinheiten), zum anderen die Architektur der Modelle – auf beiden Seiten muss man tief genug drin sein. Solche Erfahrungen ließen sich früher kaum im Schnellverfahren aufbauen; es ist eine der klassischsten Positionen mit „Talentbarriere”.

Dritte Ebene: Genau deshalb klingt „in einem halben Jahr aufgeholt” so schmerzhaft. Wenn selbst das Handwerk mit der höchsten Erfahrungsdichte nur noch eine Haltbarkeit von einem halben Jahr hat, dann ist die Haltbarkeit anderer technischer Positionen, die auf angehäufter Erfahrung beruhen, eher kürzer als länger. Das ist keine Panikmache, sondern die Einschätzung der Menschen, die in dieser Branche am besten Bescheid wissen – einen Nachruf kann jeder schreiben, aber erst wenn man sich ihn selbst schreibt, zählt er.

Zurück zum Hauptthema dieser Folge: Das Talent auf der Werkzeugebene unterliegt einer beschleunigten Abschreibung, während die Abschreibung auf der Ebene der Problemdefinition und der Ebene der Verantwortung viel langsamer verläuft. Zu welcher Ebene man sich verlagert, ist die eigentliche Frage, die dieser lange Text allen hinterlässt.


Informationsquellen dieser Ausgabe

  • Eintrag „Liu Shengyu“ auf Baidu Baike; Bericht von Tencent News vom 2026-09-16 (Identität und Position stimmen in beiden Quellen überein)
  • Tencent News / Toutiao / TechWeb / Wenxuecity: Veröffentlichung des Langbeitrags (in den frühen Morgenstunden des 2026-09-14) und Verlauf der viralen Verbreitung (ab dem 2026-09-15)
  • EET-China / TechWeb: wiedergegebene Aussagen „Es wird bei mir nicht so weit kommen, dass ich arbeitslos werde, aber ich muss mich unbedingt neu orientieren“ und „Mecha-Pilot“
  • Guancha 2026-09-16, Tencent News: Zitate aus der Zhihu-Antwort (einschließlich des Hitler-Vergleichs und der Äußerungen zu Kommunismus/2077, allesamt wiedergegebene Aussagen)
  • x.com @J_Lingshan0909: Wiedergabe der Zhihu-Antwort vom Abend des 9-15
  • cryptocity: Sorgen rund um Bildungsfragen (wiedergegebene Aussagen)
  • Zhihu: Diskussionsfrage „Was haltet ihr von Liu Shengyus ‚Ich muss mein Talent im Gestern begraben‘?“
广告 · Advertisement

Häufige Fragen

Warum hat Liu Shengyu seinen eigenen Nachruf geschrieben?

Liu Shengyu hat einen Artikel veröffentlicht, in dem er sagt, dass er sein Talent im Gestern begraben musste, weil er die AI-Beschleunigung vorangetrieben hat und innerhalb der nächsten sechs Monate bis zu einem Jahr das Niveau der AI-Operatoren erreicht oder übertreffen wird.

Welche Rolle spielt Liu Shengyu bei DeepSeek?

Liu Shengyu ist der leitende Operator-Ingenieur von DeepSeek V4.1 und verantwortet den Haupt-Attention-Operator.

Warum ist der Artikel von Liu Shengyu so viral geworden?

Der Artikel wurde viral, weil Liu Shengyu als angesehener Ingenieur spricht, die Inhalte hart und prägnant sind und der Zeitpunkt der Veröffentlichung geschickt gewählt wurde.