Die große Welle ist da: Ein strategisches Manifest von GLM-CEO Jie Tang

@bingxu_
CHINESISCH11. Juli 2026
364K
560
99
18
1.1K

TL;DR

Zhipu AI-CEO Jie Tang skizziert die „Touch High“-Strategie des Unternehmens, die sich auf langfristige Aufgaben, autonome Agenten und sich selbst entwickelnde KI konzentriert, um AGI zu erreichen.

--- Bing Xus Notiz ---

Ich bin auf einen internen GLM-Brief in der chinesischen App RedNote gestoßen, der angeblich von @jietang verfasst wurde, und habe den chinesischen Text in den Bildern ins Englische übersetzt.

--- Briefbeginn ----

Die große Welle ist hereingebrochen. Erlauben Sie mir, diesen Artikel zu nutzen, um drei Dinge zu besprechen: wer wir sind, wie wir diese Ära verstehen, und die strategische Richtung, der wir uns mit ganzer Hingabe verschrieben haben.

1. Wer Wir Sind: Grundprinzipien, Konträres Denken und Fokus

Zhipu war nie ein Unternehmen, das einfach dem neuesten Trend hinterherläuft. Wir sind aus einem Labor hervorgegangen und tragen zwanzig Jahre seiner Methodik in uns.

Diese Methodik lässt sich in drei Ideen zusammenfassen: Grundprinzipien, konträres Denken und Fokus.

Nur wer tief genug denkt, kann es wagen, eine ausreichend konträre Wahl zu treffen. Und wenn diese Wahl getroffen ist, muss man darauf vorbereitet sein, lange genug an ihr festzuhalten.

Rückblickend erscheint fast jede unserer kritischen Entscheidungen damals kontraintuitiv.

Im Jahr 2006 arbeiteten wir still an einem akademischen Suchsystem, das auf einem einzigen Desktop-Computer lief. Wir taten dies, weil wir verstanden hatten, dass die tiefere Frage dahinter – die Entdeckung der Mechanismen, die die Entwicklung akademischer Disziplinen vorantreiben – es wert war, ein Jahrzehnt der Beantwortung zu widmen.

Von 2021 bis 2022, als „Maschinen dazu zu bringen, wie Menschen zu denken“ von den meisten noch als eine verrückte Utopie angesehen wurde, lenkten wir unsere Ressourcen um, verpflichteten uns einem Modell mit Hunderten von Milliarden Parametern und bauten GLM-130B.

Das war ganze anderthalb Jahre, bevor ChatGPT die Welt im Sturm eroberte.

Dann, am 8. Januar 2026, dem Tag, an dem Zhipu seinen H-Aktien-Börsengang in Hongkong abschloss, betrachteten wir den Anlass nicht als Ziellinie, sondern als einen völligen Neuanfang. Wir beschlossen, uns vollständig der Grundlagenforschung an Basismodellen zu widmen und all unsere Anstrengungen in die nächste Generation von Modellen zu stecken.

Während andere die Börsenglocke läuteten, setzten wir uns selbst auf Null zurück.

Dies war keine Geste. Es war eine Überzeugung. Wenn das endgültige Ziel die AGI ist, dann sind kurzfristige Gewinne und vorübergehende Branchentrends lediglich die Landschaft am Wegesrand.

Was uns bis heute aufrechterhalten hat, ist ein außergewöhnliches Maß an Fokus und ein aufrichtiger, kompromissloser Idealismus.

Es hat uns zehn Jahre gekostet, ein akademisches Suchsystem von einem einzelnen Desktop-Computer zu einer Plattform zu entwickeln, die mehr als zehn Millionen Nutzern dient. Wir haben fast ein weiteres Jahrzehnt damit verbracht, große Modelle zu verfolgen, und wir werden dieses Feld weiterhin mit Entschlossenheit kultivieren.

Zhipu ist heute eine Gruppe von Menschen, die bereit sind, aus Grundprinzipien heraus zu hinterfragen, mutig genug sind, Entscheidungen zu treffen, die gegen die herkömmliche Weisheit verstoßen, und fokussiert genug, diese Entscheidungen bis zum Ende durchzuziehen.

Das ist die Quelle von Zhipus Kernwettbewerbsfähigkeit.

2. Wie Wir Diese Ära Verstehen: Die Decke der Intelligenz Wird Neu Geschrieben

Wenn es eine Sache gibt, die wir in den letzten zwanzig Jahren gelernt haben, dann ist es diese:

Die größten kommerziellen Chancen liegen nie in kleinen Anpassungen von Produkten oder Geschäftsmodellen. Sie entstehen, wenn die Decke der Intelligenz selbst einen Sprung macht.

Dies ist unser grundlegendstes Urteil über die aktuelle KI-Transformation, und es ist die Idee, die wir am meisten vermitteln wollen.

Im Kern ist diese Transformation nicht nur eine Produktinnovation oder eine Innovation des Geschäftsmodells. Es ist eine technologische Revolution, die die eigentliche Decke der Intelligenz angehoben hat.

Wer auch immer diese Decke auch nur einen Zentimeter höher drücken kann, wird die Grenzen dessen, was Tausende von Industrien zu erreichen vermögen, neu definieren können. Dieser eine Zentimeter ist genau das, worum die neue Generation von KI-Unternehmen, die auf Grundprinzipien basieren, konkurriert.

Die Evolution der Intelligenz folgt einem klaren Pfad.

Künstliche Intelligenz vollzieht nun den Übergang von Wahrnehmungsintelligenz zu kognitiver Intelligenz. Maschinen sind nicht länger darauf beschränkt zu „sehen“ und „hören“. Sie beginnen zu „verstehen“ und zu „denken“.

Der nächste Schritt zeigt direkt auf die AGI.

Wir haben eine einfache, aber anspruchsvolle Definition von AGI:

AGI ist nicht die Intelligenz eines einzelnen Genies. Sie ist die Summe aller menschlichen Intelligenz.

Sie sollte in der Lage sein, originäres Wissen auf dem Niveau der Relativitätstheorie zu schaffen. Das ist der einzige Standard, an dem wir messen, ob der wahre Gipfel erreicht ist.

Auf dem Weg zu diesem Ziel müssen mehrere Berge überquert werden. Sie sind auch die Orte, an denen die heutige technologische Welle am stärksten tobt.

Der erste Berg: Fähigkeit zu Langzeithorizont-Aufgaben

Der aufregendste Durchbruch heute ist, Modellen beizubringen, extrem lange Aufgaben zu erledigen – nicht nur sofort Fragen zu beantworten, sondern über Wochen, Monate oder sogar Jahre zu planen und auszuführen.

Ein Modell könnte beispielsweise unermüdlich in Software nach Schwachstellen suchen. Im Wesentlichen würde es die Denkweise eines weltklasse Cybersicherheitsexperten erlernen und diese Expertise dann durch die Ausdauer einer Maschine verstärken.

Der zweite Berg: Vollständig Autonome Agentensysteme

Aufbauend auf den Langzeithorizont-Fähigkeiten werden Gruppen von Agenten, die unabhängig operieren, miteinander kollaborieren und rund um die Uhr arbeiten können, zu einer neuen Form der Produktivität werden.

Wir sprachen einst vom Ein-Personen-Unternehmen, oder OPC. Aber die Technologie schreitet schneller voran als erwartet. Wir bewegen uns bereits auf das vollautomatisierte, personenlose Unternehmen, oder NPC, zu.

Drei Herausforderungen – Gedächtnis, kontinuierliches Lernen und Selbstevaluation – galten einst als unlösbar, bevor es einen grundlegenden Paradigmenwechsel gäbe. Nun, getrieben durch technologische Fortschritte und reale Anwendungen, werden sie nach und nach überwunden.

Langzeit-Kontextfähigkeiten und Retrieval-Augmented Generation (RAG) nähern sich einer brauchbaren Form von Gedächtnis. Häufigere Modelliterationen bringen uns dem kontinuierlichen Lernen näher. Grenzmodelle zeigen bereits erste Anzeichen von Selbstevaluation.

Der dritte Berg: Selbstevolution

Dies ist der schwierigste – und auch der faszinierendste – Berg von allen.

KI, die KI trainiert, nimmt bereits Gestalt an. Modelle beginnen, ihren eigenen Code zu schreiben, ihre eigenen Daten zu bereinigen und zu synthetisieren und sich selbst zu trainieren.

Dies mag mehr Rechenleistung verbrauchen, aber es spart die wertvollsten Ressourcen überhaupt: menschliche Mühe und Zeit.

Im Zeitalter der großen Modelle ist Geschwindigkeit das Wichtigste. Schnelle Iteration kann eine Kluft zwischen den Generationen in der kognitiven Fähigkeit schaffen.

Während führende Unternehmen im Ausland beginnen, Rechencluster mit einer Million oder sogar zwei Millionen KI-Chips zu bauen, könnte ihr wahrer Zweck darin bestehen, Modellen zu ermöglichen, sich selbst zu trainieren.

Was wird passieren, nachdem diese drei Berge überquert wurden?

KI wird beginnen zu lernen, was das „Selbst“ ist und was Selbstbewusstsein bedeutet. Darüber hinaus könnte sie beginnen, menschliche Emotionen zu berühren. Noch weiter entfernt liegt das Bewusstsein selbst.

Von der Wahrnehmung zur Kognition, von der Kognition zur allgemeinen Intelligenz und von der allgemeinen Intelligenz hin zur künstlichen Superintelligenz (ASI) – der Weg ist bereits geebnet.

Die große Welle ist hereingebrochen, und sie ist nicht umkehrbar. Dies ist nicht nur unsere eigene Ansicht.

In seinem Bericht From AGI to ASI zieht Google DeepMind eine klare Schlussfolgerung: Selbst wenn die Fähigkeiten eines einzelnen Modells dauerhaft auf menschlichem Niveau blieben, könnte Superintelligenz dennoch durch rohes Wachstum der Rechenleistung entstehen.

Ihre Prognose ist, dass die Zahl der weltweit operativen AGI-Instanzen, wenn sie sich jährlich verzehnfacht, innerhalb von fünf Jahren 100 Millionen erreichen wird.

Diese Agenten würden dieselbe zugrunde liegende Intelligenz teilen, mit einer um das Hundertfache gesteigerten Effizienz denken und Erfahrungen zu praktisch null Kosten replizieren. Auf kollektiver Ebene würden sie effektiv ASI darstellen.

Mit anderen Worten: Der Weg von AGI zu ASI erfordert sowohl algorithmische Durchbrüche als auch die Konzentration von Rechenressourcen in einem beispiellosen Ausmaß.

Dieser irreversible Trend wird den gesamten Technologie-Stack von oben nach unten durchdringen.

Wenn AGI eintrifft, müssen die heutigen Anwendungen möglicherweise alle als KI-native Systeme neu aufgebaut werden – oder sind vielleicht gar nicht mehr nötig.

Betriebssysteme selbst könnten neu geschrieben werden. In Zukunft könnte das, was Sie sehen, wenn Sie einen Computer einschalten, ein „LLM OS“ sein, bei dem jede Funktion auf Abruf generiert wird.

Noch tiefer gehend stellt dies eine Herausforderung für die Von-Neumann-Architektur dar, die die Computertechnik der letzten achtzig Jahre untermauert hat.

Finanzen, Recht, E-Commerce, das Internet – keine Branche wird unberührt bleiben.

Viele Freunde sind zu mir gekommen und haben gesagt, sie wollten ihre Unternehmen transformieren und mit der KI Schritt halten. Doch nur eine kleine Anzahl hat wirklich erkannt, dass diese irreversible Transformation bereits begonnen hat.

3. Die Richtung, Der Wir Unsere Ganze Kraft Widmen Werden: „Touch High“

Sobald der Trend klar ist, bleibt nur noch die Wahl.

Und Zhipus Wahl ist, wie immer, konträr.

Zu einer Zeit, in der die gesamte Branche die kommerzielle Monetarisierung von KI beschleunigt, haben wir uns entschieden, nach oben zu drängen und den nächsten technologischen Durchbruch zu verfolgen.

Wir nennen diese Strategie die „Touch High“-Initiative.

In diesem historischen Moment, in dem künstliche Intelligenz von Wahrnehmung und Kognition zur vollständig allgemeinen Intelligenz fortschreitet, wird Zhipu höher greifen und die physikalischen und algorithmischen Grenzen der heutigen Technologie herausfordern.

In den nächsten zwei Jahren planen wir eine große strategische Investition – nicht im Streben nach kurzfristigen Anwendungsumsätzen, sondern direkt auf die nächste Grenze der AGI ausgerichtet.

Diese Investition wird sich auf vier Kernmotoren konzentrieren.

Erstens: Langzeithorizont-Aufgaben

Wir werden KI über sofortige Frage-Antwort-Interaktionen hinaus zur Ausführung groß angelegter Projekte bewegen.

Dies bedeutet die Entwicklung einer neuen Generation von Gedächtnisarchitekturen, die es Modellen ermöglichen, während des gesamten Lebenszyklus eines Projekts zu lernen, zu handeln und Wissen zu behalten.

Modelle müssen in der Lage sein, während der Arbeit zu lernen, während des Lernens zu handeln und sich zu merken, was sie getan haben. Sie müssen auch die übergeordnete Fähigkeit erlangen, ein ehrgeiziges Ziel – wie das Designen eines neuen Krebsmedikamentenmoleküls – in Tausende von unabhängig ausführbaren Teilaufgaben zu zerlegen.

Zweitens: Autonome Agentensysteme

Wir werden von intelligenten Assistenten zu digitalen Angestellten übergehen.

Unser Ziel ist es, Gesellschaften von Tausenden oder sogar Zehntausenden von Agenten aufzubauen, die jeweils eine eigene berufliche „Persönlichkeit“ und einen eigenen Fähigkeitssatz besitzen.

Diese Agenten werden unabhängig debattieren, kollaborieren, Code überprüfen und Ressourcen zuweisen, wodurch eine digitale Produktivität mit einem Autonomiegrad entsteht, der mit autonomen Fahrsystemen vergleichbar ist.

Drittens: Vollständig Selbstständiges Training

Da das Angebot an hochwertigen, von Menschen generierten Daten zur Neige geht, werden wir Rechenleistung in Treibstoff für die Evolution verwandeln.

Dies bedeutet den Bau von Fabriken für hochwertige synthetische Daten, die Nutzung von KI-gegen-KI-Konkurrenz durch Self-Play, um Wissen von Grund auf zu generieren, und die Ausstattung von Systemen mit der Fähigkeit, ihren eigenen Code innerhalb sicherer Sandboxen umzuschreiben.

Das Ziel ist es, das Tempo der Evolution von den physischen Einschränkungen menschlicher Ingenieure zu befreien.

Viertens: Sicherheits-Governance nach Höchstem Standard

Von den vier Motoren ist dies derjenige, den ich am meisten betonen möchte.

Je leistungsfähiger die KI wird, desto robuster müssen ihre Sicherheitsbeschränkungen sein.

Von Anfang an hat Zhipu einen Leitgrundsatz aufgestellt:

KI muss dem menschlichen Wohlergehen und den nationalen strategischen Prioritäten dienen.

Das Unternehmen lehnt nachträglich aufgesetzte Sicherheits-Patches ab. Stattdessen strebt es danach, menschliche Ethik, soziale Normen und nationale Gesetze und Vorschriften als grundlegende Axiome in die Wertfunktion des Modells zu kodieren.

Wir planen, Ressourcen in der Größenordnung von zig Milliarden für die Förderung der mechanistischen Interpretierbarkeit bereitzustellen – um die neuronale Logik hinter Modellentscheidungen zu klären und Black-Box-Systeme in transparente, erklärbare zu verwandeln.

Gleichzeitig werden wir uns aktiv an der internationalen KI-Governance beteiligen, um den Missbrauch von KI-Technologie zu verhindern.

Dieses Gefühl der Dringlichkeit ist nicht unbegründet.

Wenn die fortschrittlichsten Grenzmodelle im Ausland ihre vollständige öffentliche Veröffentlichung aus Sicherheitsgründen verzögern und ihre Unternehmensführer öffentlich warnen, dass die weitreichenden Auswirkungen der KI das globale Kräfteverhältnis tiefgreifend verändern werden, müssen wir klar sehen:

Die Entwicklung von Superintelligenz und die Forschung zu Superalignment müssen parallel voranschreiten.

Dies ist auch eine Frage, die wir immer wieder prüfen, wenn wir mit disruptiven Technologien konfrontiert werden.

Die Geschichte hat immer wieder gezeigt, dass Sicherheit kein optionales Zubehör mehr ist, wenn eine Technologie mächtig genug wird, um den Lauf der Zivilisation zu verändern. Sie wird zur grundlegenden Voraussetzung für die weitere Existenz und die erlaubte Nutzung der Technologie.

4. Ein Offenes Ökosystem: Die Grundlage für Breitenzugang zu Intelligenz und Sicherheits-Governance

Wir haben immer geglaubt, dass künstliche Intelligenz als strategische Technologie, die die Zukunft gestalten wird, ohne ein offenes und kollaboratives Industrieökosystem keine nachhaltige langfristige Entwicklung erreichen kann.

Der Wert der Grenzintelligenz liegt nicht nur in den technologischen Durchbrüchen selbst, sondern auch darin, ob sie breit Tausende von Industrien befähigen und jedem Entwickler nutzen kann.

Wir sind fest davon überzeugt, dass echte Sicherheit nicht auf technologischer Abschottung oder Barrieren aufbaut.

Sie entsteht aus breiter Beteiligung, Teilen, gemeinsamer Kreation und Aufsicht, die offen und transparent durchgeführt werden.

Es ist dieses tiefe Engagement für die breite Zugänglichkeit von Technologie, das Zhipus strategische Reaktion geprägt hat.

Kürzlich haben wir GLM-5.2 veröffentlicht, unser bisher leistungsfähigstes Open-Source-Modell.

Es unterstützt ein wirklich praktisches Kontextfenster von einer Million Token, ist weiterhin führend bei Aufgaben mit langem Horizont und steht allen Nutzern zur Verfügung.

Es wird auch offiziell unter der sehr freizügigen MIT-Lizenz als Open Source veröffentlicht. Jeder wird es herunterladen, bereitstellen und kommerziell nutzen können, ohne Einschränkungen hinsichtlich der Art des Nutzers oder der Organisation.

Dies ist die feste Position des Unternehmens, ausgedrückt in der Form seines Produkts.

Wir entscheiden uns dafür, an einen anderen Weg zu glauben:

Grenzintelligenz sollte nicht nur einer Handvoll Auserwählter gehören, noch sollte der Zugang zu ihr jederzeit von einer kleinen Gruppe von Regelsetzern entzogen werden können.

Sie sollte offen, nutzbar und erweiterbar sein – und sie sollte jedem Entwickler dienen.

Dies steht nicht im Widerspruch zu „Touch High“. Vielmehr sind die beiden Seiten derselben Strategie, die sich ergänzen.

Mit der einen Hand greifen wir nach oben, um die Grenzen der Intelligenz herauszufordern. Mit der anderen bauen wir Straßen nach unten, um die fortschrittlichsten Fähigkeiten so offen und breit zugänglich wie möglich zu machen.

Die Höhen, die wir erreichen, gehören der gesamten Menschheit, und die Straßen, die wir bauen, gehören allen.

5. Schlussfolgerung: Warum Jetzt und Warum Wir?

Manche mögen fragen:

Warum widmet Zhipu nach dem Börsengang weiterhin seine Kernressourcen dem Höhergreifen in der unsichersten Richtung?

Weil wir an eine einfache Wahrheit glauben:

Diejenigen, die den Gipfel wirklich erreichen, verwandeln den Berg in eine Straße.

Die grundlegende Einsicht, zu der wir gelangten, wurde einst durch das Wudao Large Model-Projekt zu einer gemeinsamen Überzeugung von Hunderten von Wissenschaftlern kristallisiert.

Später, durch Zhipus industrielle Investitionen und das breitere Ökosystem, wurde sie zu einer Grundlage, von der aus eine neue Generation von Unternehmern abheben konnte.

Heute wollen wir diese Straße höher und breiter bauen –

Hoch genug, um uns selbst zu schützen und die nationale Sicherheit zu gewährleisten;

Hoch genug, um der Menschheit die Möglichkeit zu geben, mehr vom Unbekannten zu erforschen und die Geheimnisse des Universums zu lüften;

Und breit genug, damit jeder Entwickler und jedes Team einen Weg nach oben findet.

Im Zeitalter der AGI könnten Dinge, die einst für immer unerreichbar schienen, zum ersten Mal möglich werden.

Dies ist das größte Glück unserer Generation – und auch ihre schwerste Verantwortung.

Die große Welle ist hereingebrochen, und der Trend ist unumkehrbar.

Zhipu beabsichtigt, derjenige zu sein, der sich der heranrollenden Welle stellt und weiter nach oben greift.

Alles unterhalb des Gipfels ist ein Misserfolg.

Dieses Mal ist die Höhe, die wir zu erreichen suchen, eine, die der gesamten Menschheit gehört.

Tang Jie

Gründer von Zhipu AI

11. Juli 2026

In YouMind remixen

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Für Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mühsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum Entschlüsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken