OpenAI setzt auf Schwerindustrie: Eigene Chips, DRAM-Horten und biologische Großprojekte

OpenAI
OpenAI Pivots to Heavy Industry with Custom Silicon, DRAM Hoarding, and Biological Moonshots
OpenAI integriert seine Betriebsabläufe massiv vertikal: Das Unternehmen entwickelt gemeinsam mit Broadcom den Spezialchip „Jalapeño“, sichert sich DRAM-Wafer-Lieferungen bis 2029 und investiert 500 Millionen Dollar in eine Initiative zur Ausrottung von Viren.

Seit Jahren operiert die Forschung an der Spitze der Künstlichen Intelligenz primär als Software-Unternehmen, das auf gemieteter Infrastruktur basiert. Modellentwickler trainierten zunehmend massivere Transformer-Netzwerke auf gemieteten Clustern aus Standard-Beschleunigern und verließen sich darauf, dass kommerzielle Silizium-Anbieter und öffentliche Hyperscaler die immensen Investitionskosten und die logistischen Herausforderungen der physischen Fertigung bewältigen. Dieses Gefüge bricht auf. OpenAI vollzieht einen aggressiven Wandel vom Softwarelabor zum industriellen Kraftzentrum und dringt in die unteren Schichten des physischen Technologie-Stacks vor, um eigenes Silizium zu kontrollieren, über Rohstoffe für Halbleiter zu bestimmen und biotechnologische „Moonshot“-Projekte zu finanzieren.

Das Ausmaß dieses Wandels wurde in der vergangenen Woche unübersehbar. Details wurden bekannt zu „Jalapeño“, einem internen anwendungsspezifischen integrierten Schaltkreis (ASIC), der gemeinsam mit Broadcom entwickelt wurde; zu strategischen Beschaffungsvereinbarungen, die bis 2029 bis zu 40 Prozent der weltweiten Produktion von rohen DRAM-Wafern sichern sollen; sowie zu einer gemeinsamen Investition in Höhe von 500 Millionen US-Dollar zusammen mit Anthropic, Stripe und Bill Gates zur Gründung von Intercept, einer Organisation, die darauf ausgelegt ist, gewöhnliche Erkältungen und verbreitete Atemwegserreger auszurotten. Jede dieser Ankündigungen für sich genommen stellt einen ambitionierten unternehmerischen Schritt dar. Zusammengenommen offenbaren sie eine aggressive, vertikal integrierte Strategie, die darauf ausgelegt ist, die primären mechanischen, thermischen und versorgungstechnischen Engpässe zu umgehen, die derzeit die Skalierung autonomer Intelligenz begrenzen.

Der Jalapeño-ASIC und das Co-Design agentischer Hardware

Die Entwicklung von maßgeschneidertem Silizium ist weder billig noch schnell; historisch gesehen benötigt sie vier bis fünf Jahre von der architektonischen Spezifikation bis zum Tape-out und der finalen Konfektionierung. Mit Jalapeño versuchen OpenAI und der Netzwerk-Silizium-Gigant Broadcom, diesen Entwicklungszyklus durch eine aggressive Closed-Loop-Methodik zu verkürzen: Dabei werden autonome Software-Agenten eingesetzt, um die Befehlssatzarchitektur der Hardware sowie den Register-Transfer-Level (RTL)-Code zu schreiben, zu verifizieren und zu optimieren. Durch das direkte Einbinden spezialisierter agentischer Modelle in den Design-Prozess können Logiksynthese und Trace-Routing kontinuierlich gegen gezielte Inferenz-Workloads bewertet werden.

Broadcom bringt eine nachgewiesene Expertise in dieses Joint Venture ein. Nach Jahren der gemeinsamen Entwicklung maßgeschneiderter Tensor Processing Units (TPUs) für Google verfügt das Unternehmen über die nötigen IP-Blöcke, SerDes-High-Speed-Schnittstellen und Verpackungskompetenzen, um die Verbindungsgeschwindigkeiten pro Die zu maximieren. Jalapeño ist spezifisch auf die operativen Mechanismen des Betriebs von Large Language Models ausgelegt und direkt darauf ausgerichtet, die ChatGPT-Flotte, Codex-APIs und Workflows für hochgradig gleichzeitige autonome Agenten auszuführen. Allzweck-Grafikprozessoren (GPUs) tragen Siliziumfläche und Energie-Overhead für Legacy-Rasterisierung, wissenschaftliche Berechnungen mit doppelter Genauigkeit und flexible Rechenpfade, die bei der Transformer-Matrixmultiplikation schlicht nicht genutzt werden.

Kontrolle über das physische Substrat: 40 % der unzersägten DRAM-Wafer

Silizium-Logik ist ohne den Zugriff auf Speicher mit hoher Bandbreite funktionslos. Der limitierende Faktor beim Betrieb von Spitzenmodellen ist selten die reine Rechenleistung pro Sekunde; es sind Speicherbandbreite und -kapazität. Große Modelle erfordern, dass enorme Mengen an Parametern mit Latenzen im einstelligen Nanosekundenbereich über Siliziumgrenzen hinweg verschoben werden, was zu den modernen High-Bandwidth-Memory (HBM)-Stacking-Architekturen geführt hat, die in Taiwan und Südkorea zu akuten Fertigungsengpässen führen.

OpenAIs Antwort auf diese Speicherwand ist ein waghalsiges Lieferkettenmanöver: Der Abschluss von Verträgen über schätzungsweise 40 Prozent der weltweiten Produktion von rohen, unzersägten DRAM-Wafern bis 2029. Anstatt standardmäßig vierteljährlich fertige Speichermodule zu verhandeln, sichert sich die Organisation die zugrunde liegenden, unverarbeiteten Silizium-Wafer direkt bei Herstellern wie Micron Technology. Dieser Ansatz isoliert das Unternehmen gegen extreme Marktzyklen und fertigungstechnische Engpässe.

Aus Sicht des Wirtschaftsingenieurwesens bietet die Sicherung unzersägter Wafer vor dem Testen, Schneiden und Verpacken tiefgreifende Vorteile für das Design kundenspezifischer Systeme:

  • Das Umgehen der Standard-Schnittstellen für handelsübliche Speichermodule erlaubt es den Ingenieurteams, proprietäre 2.5D- und 3D-heterogene Verpackungsschemata zu implementieren, bei denen rohe DRAM-Dies direkt auf kundenspezifische Interposer neben den Logikkernen gebondet werden.
  • Langfristige Materialreservierungen bieten die strukturelle Garantie, die erforderlich ist, um mehrjährige Fertigungsläufe bei Foundries wie TSMC zu planen, ohne das Risiko, dass Logikeinheiten aufgrund fehlenden Arbeitsspeichers ungenutzt bleiben.

Können Siliziumtechnik und KI die biologische Entropie lösen?

Während die Hardware-Operationen von OpenAI darauf ausgelegt sind, die unmittelbaren thermodynamischen und physischen Zwänge beim Betrieb digitaler Netzwerke zu lösen, richtet sich die dritte große Initiative auf biologische Systeme. In Partnerschaft mit dem Hauptkonkurrenten Anthropic, der Fintech-Plattform Stripe und dem Philanthropen Bill Gates hat OpenAI insgesamt 500 Millionen US-Dollar zugesagt, um Intercept zu unterstützen – eine Organisation, die darauf spezialisiert ist, verbreitete Atemwegsviren, von saisonalen Rhinoviren bis hin zu Influenza, auszurotten.

Auf den ersten Blick erscheint es unzusammenhängend, dass ein Unternehmen für Künstliche Intelligenz klinische Virologie finanziert, während sein Kerngeschäft in Rechenzentren liegt. In der Realität sind moderne Strukturbiologie und makromolekulare Technik jedoch zu computergestützten Disziplinen geworden, die denselben algorithmischen Paradigmen unterliegen wie die Transformer-Modelle für natürliche Sprache. Die mathematischen Frameworks, die zur Modellierung von Syntax und zur Vorhersage sequenzieller Token verwendet werden, lassen sich direkt auf die Vorhersage von Aminosäuresequenzen, tertiären Proteinfaltungs-Konfigurationen und makromolekularen Docking-Dynamiken übertragen.

Atemwegsviren stellen ein immenses thermodynamisches und evolutionäres Problem dar: hohe Mutationsraten, Antigen-Variabilität und unterschiedliche Mechanismen des Zelleintritts. Historisch gesehen war die Impfstoffentwicklung reaktiv – Immunogene wurden erst entwickelt, nachdem Stämme auftauchten. Intercept beabsichtigt, dieses Paradigma in Richtung generativer Biologie zu verschieben, indem tiefe neuronale Architekturen eingesetzt werden, um die Fitnesslandschaft von Viren zu analysieren und ultrakonservierte Epitope zu identifizieren – strukturelle Regionen viraler Proteine, die nicht mutieren können, ohne den Erreger funktionsunfähig zu machen. Computerintensive Screenings können Milliarden von potenziellen Bindungsproteinen und breit neutralisierenden Antikörpern in silico simulieren, noch bevor im Labor ein einziger Mikroliter Reagenz pipettiert wird.

Die Beteiligung rivalisierender Entwickler von Basismodellen deutet auf eine tiefere strategische Konvergenz hin. Sowohl OpenAI als auch Anthropic wollen zeigen, dass generative Rechenleistung greifbare gesellschaftliche Dividenden über synthetische Texte und automatisierte Büroabläufe hinaus erbringt. Die Ausrottung systemischer viraler Krankheiten bietet eine klare Rendite: Saisonale Atemwegsinfektionen entziehen der globalen Produktivität jährlich hunderte Milliarden Dollar, setzen Arbeitskräfte außer Gefecht und belasten das Humankapital nachhaltig. Wenn computergestützte Intelligenz ein Jahrzehnt biologischer Entdeckung in Monate komprimieren kann, löst sich die Grenze zwischen digitaler Rechenleistung und molekularer Fertigung auf.

Das Wiederaufleben des Industriemonopols

Was OpenAI aufbaut, ähnelt eher den vertikalen Industriemonopolen des zwanzigsten Jahrhunderts als den Plattform-Softwareunternehmen des einundzwanzigsten. Henry Ford entwarf nicht nur Automobile; er baute den River-Rouge-Komplex, besaß die Eisenerzminen, bewirtschaftete Kautschukplantagen und kontrollierte die Bahnkorridore, die die Teile zur Fertigungslinie beförderten. Wenn externe Lieferanten Engpässe verursachten, internalisierte Ford die Lieferkette.

Doch vertikale Integration in dieser Geschwindigkeit birgt eine enorme operative Fragilität. Die Bindung an kapitalintensive, mehrjährige Lieferkettenvereinbarungen setzt ein Unternehmen monumentalen Ausführungsrisiken aus, falls sich die zugrunde liegenden algorithmischen Architekturen plötzlich ändern. Sollte die Dominanz transformerbasierter Aufmerksamkeitsmechanismen durch rekurrente State-Space-Modelle oder neuartige neuromorphe Analog-Architekturen abgelöst werden, die keine massiven Speicherpools mit hoher Bandbreite benötigen, könnten Millionen gesicherter DRAM-Wafer von einem operativen Vermögenswert zu einer teuren Verbindlichkeit in der Bilanz werden. Für den Moment jedoch setzt OpenAI seine Zukunft auf eine einzige Prämisse: dass die Zukunft der Intelligenz nicht allein durch Zeilen von Code entschieden wird, sondern durch die physische Kapazität, Silizium, Lieferketten und menschliche Biologie neu zu gestalten.

Noah Brooks

Noah Brooks

Mapping the interface of robotics and human industry.

Georgia Institute of Technology • Atlanta, GA

Readers

Leserfragen beantwortet

Q Was ist OpenAIs kundenspezifischer Jalapeño-Chip und wie wird er entwickelt?
A Jalapeño ist ein unternehmenseigener, anwendungsspezifischer integrierter Schaltkreis (ASIC), der gemeinsam von OpenAI und Broadcom entwickelt wurde, um die Inferenz großer Sprachmodelle für Arbeitslasten wie ChatGPT und autonome Agenten zu beschleunigen. Das Projekt nutzt autonome KI-Agenten, um Befehlssatzarchitekturen und Register-Transfer-Level-Code zu schreiben, zu verifizieren und zu optimieren, wodurch der traditionelle mehrjährige Hardware-Designzyklus drastisch verkürzt und gleichzeitig der unnötige Silizium-Overhead vermieden wird, der bei Allzweck-Grafikprozessoren üblich ist.
Q Warum sichert sich OpenAI Direktverträge für ungeschnittene DRAM-Wafer?
A Speicherbandbreite und Latenz stellen bei der Bereitstellung massiver Transformer-Modelle große Engpässe dar. Durch die vertragliche Sicherung von bis zu vierzig Prozent der weltweiten Produktion roher, ungeschnittener DRAM-Wafer (Dynamic Random Access Memory) bis 2029 umgeht OpenAI die Standardbeschränkungen der kommerziellen Verpackung. Dieser direkte Zugang ermöglicht es Ingenieuren, kundenspezifische 2,5D- und 3D-heterogene Verpackungen zu implementieren, bei denen Speicherchips direkt neben Prozessorkernen angebracht werden, während das Unternehmen gleichzeitig vor Marktzyklen und Lieferunterbrechungen geschützt wird.
Q Was ist das Ziel der von OpenAI mitfinanzierten Intercept-Initiative?
A Intercept ist ein 500-Millionen-Dollar-Joint-Venture, das von OpenAI, Anthropic, Stripe und Bill Gates unterstützt wird und darauf abzielt, häufige Atemwegserreger, einschließlich saisonaler Rhinoviren und Influenza, auszurotten. Die Initiative nutzt generative künstliche Intelligenz und Transformer-Architekturen, um die Strukturbiologie rechnerisch zu behandeln. Dabei werden Proteinfaltungskonfigurationen und makromolekulare Docking-Dynamiken vorhergesagt, um proaktive, universelle Abwehrmechanismen gegen schnell mutierende Virusstämme zu entwickeln.
Q Welche Vorteile bietet die kundenspezifische ASIC-Entwicklung gegenüber kommerziellen GPUs für KI-Arbeitslasten?
A Kommerzielle Grafikprozessoren tragen aufgrund von Legacy-Hardwarekomponenten, wie etwa Hardware für die Rasterisierung und Einheiten für Berechnungen mit doppelter Genauigkeit, die von Transformer-Modellen nicht genutzt werden, Nachteile in Bezug auf Siliziumfläche und elektrischen Energieverbrauch. Maßgeschneiderte anwendungsspezifische integrierte Schaltkreise eliminieren diese redundanten Rechenpfade. Diese Spezialisierung ermöglicht es Entwicklern, Hochgeschwindigkeits-Interconnects, maßgeschneiderte Speicherbandbreiten und Energieeffizienz zu priorisieren, die speziell für die Inferenz von Modellen mit hoher Parallelität und Agenten-Workflows optimiert sind.

Haben Sie eine Frage zu diesem Artikel?

Fragen werden vor der Veröffentlichung geprüft. Wir beantworten die besten!

Kommentare

Noch keine Kommentare. Seien Sie der Erste!