Größe und Marktanteil des chinesischen GPU-Markts
Analyse des chinesischen GPU-Markts von Mordor Intelligence
Die Größe des chinesischen GPU-Markts wird für 2025 auf 42,30 Milliarden USD, für 2026 auf 48,98 Milliarden USD und bis 2031 auf 117,91 Milliarden USD prognostiziert, mit einer CAGR von 19,21 % von 2026 bis 2031. Anhaltender Druck durch Exportkontrollen, eine Welle inländischer Chip-Börsengänge und rekordhohe Kapitalausgaben der Hyperscaler bilden gemeinsam das Fundament dieser Expansion. Hyperscaler steigerten die täglichen Inferenzvolumina im Jahr 2025 um mehr als 260 %, was die Versorgung mit lokalen und importierten Beschleunigern weiter verknappt. Provinzielle Subventionen für Strom und Grundstücke verbesserten die Wirtschaftlichkeit von Rechenzentren, während ein paralleler Anstieg bei Automotive-ADAS-Silizium die Nachfrage über Cloud-Workloads hinaus diversifizierte. Da diskrete Beschleuniger im Jahr 2025 einen erheblichen Anteil am Umsatz erzielten, zeigte der chinesische GPU-Markt eine klare Präferenz für Hochbandbreiten-Rack-Scale-Deployments gegenüber integrierten Alternativen.
Wichtigste Erkenntnisse des Berichts
- Nach Integrationstyp hielten diskrete GPUs im Jahr 2025 einen Marktanteil von 65,73 % am chinesischen GPU-Markt und werden voraussichtlich bis 2031 mit einer CAGR von 19,88 % wachsen.
- Nach Geräteanwendung entfielen im Jahr 2025 32,74 % des chinesischen GPU-Markts auf Server und Rechenzentrumsbeschleuniger, die bis 2031 voraussichtlich mit einer CAGR von 19,94 % wachsen werden.
Hinweis: Die Marktgröße und Prognosezahlen in diesem Bericht werden mithilfe des proprietären Schätzungsrahmens von Mordor Intelligence erstellt und mit den neuesten verfügbaren Daten und Erkenntnissen vom Januar 2026 aktualisiert.
Trends und Erkenntnisse im chinesischen GPU-Markt
Analyse der Treiberwirkung*
| TREIBER | (~) % AUSWIRKUNG AUF DIE CAGR-PROGNOSE | GEOGRAFISCHE RELEVANZ | ZEITHORIZONT DER AUSWIRKUNG |
|---|---|---|---|
| Explosionsartige Nachfrage nach KI/ML-Trainings-Workloads | +6.2% | National, konzentriert in Peking, Hangzhou, Shenzhen | Mittelfristig (2–4 Jahre) |
| Wachsende Cloud- und Colocation-Rechenzentrumsbauten | +5.5% | Östliche Provinzen, Innere Mongolei, Guizhou | Mittelfristig (2–4 Jahre) |
| Staatliche Anreize zur Halbleiter-Eigenversorgung | +4.8% | National, mit starken Programmen in Shanghai, Peking, Guangdong | Langfristig (≥ 4 Jahre) |
| Schnelle Expansion des inländischen Gaming-Ökosystems | +3.1% | Tier-1- und Tier-2-Städte landesweit | Kurzfristig (≤ 2 Jahre) |
| Umstieg der Automobilhersteller auf GPU-zentrierte ADAS-Simulation | +2.3% | Fertigungszentren in Guangdong, Shanghai, Anhui | Mittelfristig (2–4 Jahre) |
| Aufstieg einheimischer RISC-V-basierter GPU-Start-ups | +1.9% | Forschungs- und Entwicklungscluster in Peking, Shanghai, Shenzhen | Langfristig (≥ 4 Jahre) |
| Quelle: Mordor Intelligence | |||
Explosionsartige Nachfrage nach KI/ML-Trainings-Workloads
Chinesische Hyperscaler verbrauchten im Jahr 2025 fast 4 Millionen KI-Beschleuniger und übertrafen damit die Lieferungen aller anderen Regionen zusammen. ByteDances Ausgaben von 14 Milliarden USD für GPUs übertrafen mehrere mittelgroße globale Cloud-Anbieter, während Alibabas Infrastrukturprogramm im Wert von 52,7 Milliarden USD Strom, Kühlung und Gebäudehüllen umfasst, die auf dichte Racks ausgelegt sind.[1]Financial Times, "Alibaba kündigt KI-Infrastrukturbudget von 52,7 Milliarden USD an," ft.com Der tägliche Inferenz-Traffic stieg von 10,2 Billionen Token im ersten Halbjahr 2025 auf 37 Billionen Token im zweiten Halbjahr 2025, was sowohl inländische als auch ausländische Anbieter zur Rationierung des Angebots zwang. Alibabas T-Head Zhenwu 810E wurde bis Februar 2026 in 470.000 Einheiten ausgeliefert, jede mit 96 GB HBM2e und 700 GB/s Bandbreite, und erzielte einen annualisierten Umsatz von mehr als 10 Milliarden RMB (1,4 Milliarden USD).[2]South China Morning Post, "Zhenwu 810E erreicht 470.000 Einheiten in rasantem Hochlauf," scmp.com Die anhaltende Knappheit bei Beschleunigern ermöglichte eine im April 2026 angekündigte Preiserhöhung von 5–34 %.
Wachsende Cloud- und Colocation-Rechenzentrumsbauten
Hangzhous mehrjährige GPU-Beschaffung im Wert von 3,7 Milliarden USD bildet die Grundlage für Cluster, die bis Mitte 2026 voraussichtlich 100.000 Karten überschreiten werden. Alibaba und China Telecom aktivierten einen Standort in Guangdong mit 10.000 Zhenwu-Chips, der mehr als 400 Unternehmen 1,2 Exaflops FP16-Durchsatz liefert. Die Future Network Test Facility verband Peking, Shanghai und Shenzhen mit einem 2.000 km langen Glasfaser-Backbone, der die Latenz zwischen den Städten auf unter 5 ms reduzierte und föderierte Modelltrainings-Workflows ermöglicht. Der nationale Stromverbrauch von Rechenzentren wird bis 2030 voraussichtlich steigen, was Betreiber dazu veranlasst, sich in der Nähe erneuerbarer Energiequellen in Qinghai und Gansu anzusiedeln. Baidu und Huawei nutzten proprietäres Kunlunxin- und Ascend-Silizium, um Cloud-GPU-Instanzen anzubieten und einen erheblichen Anteil am inländischen GPU-as-a-Service-Umsatz zu sichern.
Staatliche Anreize zur Halbleiter-Eigenversorgung
Zentrale und provinzielle Haushalte stellten im Jahr 2025 70 Milliarden USD für Chip-Programme bereit, wobei 15 Milliarden RMB (2,1 Milliarden USD) explizit für GPU-Architektur, Packaging und HBM-Alternativen vorgesehen waren. Shanghai gewährte Nutzern inländischer GPUs Stromsubventionen von 50 %, was die Betriebskosten um etwa 0,35 RMB (0,05 USD) pro kWh senkte und die Gesamtbetriebskosten um fast ein Fünftel reduzierte. Eine 30-prozentige Steuerrückerstattung für Forschung und Entwicklung senkte die effektiven Steuersätze für qualifizierte Designhäuser auf unter 10 % und beschleunigte die Rekrutierung von Fachkräften aus Taiwan und dem Silicon Valley. Guangdong stellte 8 Milliarden RMB (1,1 Milliarden USD) als Meilensteinzahlungen für 7-nm-Tape-outs bereit und verkürzte die Designzyklen von 36 Monaten auf etwa 24 Monate. Diese Anreize stärkten den chinesischen GPU-Markt gegen ausländische Versorgungsschocks und befeuerten eine Welle von Börsengangsaktivitäten.
Schnelle Expansion des inländischen Gaming-Ökosystems
Im dritten Quartal stiegen die Lieferungen von Gaming-GPUs, da Verbraucher vor den erwarteten RTX-5060-Markteinführungen aufrüsteten. Der nationale PC-Markt verzeichnete Wachstum, wobei Gaming-Desktops und Laptops mit hoher Bildwiederholrate die Metriken für diskrete Ausstattungsraten anführten. Colorful bewahrte seinen Status als Boardpartner durch feuchtigkeitsoptimierte Kühllösungen und erweiterte Garantien, die auf die südlichen Provinzen zugeschnitten sind. Provinzregierungen investierten in Esports-Veranstaltungsorte und stimulierten damit die Nachfrage nach Mittelklasse-GPUs mit Raytracing-Fähigkeit in Tier-1-Städten. Obwohl im Dezember ein Lieferrückgang aufgrund von RTX-5060-Engpässen zu verzeichnen war, erholten sich die Zuteilungen im ersten Quartal, als Nvidia China priorisierte, um seinen Marktanteil zu verteidigen.
Analyse der Hemmnisse*
| HEMMNIS | (~) % AUSWIRKUNG AUF DIE CAGR-PROGNOSE | GEOGRAFISCHE RELEVANZ | ZEITHORIZONT DER AUSWIRKUNG |
|---|---|---|---|
| US-Exportkontrollen für fortschrittliche GPU-Knoten | −3.8% | Landesweit, am stärksten für Hyperscaler | Kurzfristig (≤ 2 Jahre) |
| Engpässe bei Foundry-Kapazitäten für 7 nm und darunter | −2.9% | Fabs in Shanghai und Shenzhen, Abhängigkeit von Überseeknoten | Mittelfristig (2–4 Jahre) |
| Strengere Stromverbrauchsquoten für Hyperscale-Standorte | −1.6% | Zentren in der Inneren Mongolei, Guizhou, Ningxia | Mittelfristig (2–4 Jahre) |
| Mangel an erfahrenen GPU-Architektur-Fachkräften | −1.2% | Designzentren in Peking, Shanghai, Shenzhen | Langfristig (≥ 4 Jahre) |
| Quelle: Mordor Intelligence | |||
US-Exportkontrollen für fortschrittliche GPU-Knoten
Die Regelungen vom Oktober 2023 unterbanden Lieferungen von H100 und A100 nach China und zwangen Nvidia zur Einführung von Varianten mit geringerer Bandbreite wie H20, L20 und L2. AMD verbuchte eine Wertberichtigung von 800 Millionen USD auf den MI300X, nachdem Lizenzen verweigert wurden, und verlagerte den Fokus auf die abgespeckte MI308-Linie. Peking genehmigte später 400.000 H200-Einheiten für ausgewählte Hyperscaler, erhob jedoch einen Zoll von 25 %, was die Landekosten auf 10.000 USD pro Karte erhöhte. NVIDIAs kurze H200-Produktionspause Ende 2025 verdeutlichte die anhaltende politische Volatilität. Leistungslücken zwingen inländische Labore dazu, etwa 5 Huawei Ascend 910C-Boards einzusetzen, um eine einzelne H100 zu ersetzen, was die Rack-Dichte und den Strombedarf erhöht.
Engpässe bei Foundry-Kapazitäten für 7 nm und darunter
TSMCs Lieferzeiten für 3 nm überschritten bis Q4 2025 die 50-Wochen-Marke, während CoWoS-Packaging-Slots bis Mitte 2026 ausgebucht waren. SMIC strebt bis Ende 2026 100.000 Wafer pro Monat bei 7 nm und 5 nm an, erzielt jedoch noch keine kostenkonkurrenzfähigen Ausbeuten. Inländische Start-ups setzen daher auf Chiplet-Designs wie Birens BR100, der vier 7-nm-Rechendies um einen 14-nm-I/O-Hub verbindet, um das Risiko von Einzelchip-Defekten zu umgehen. Hua Hongs 7-nm-Pilotlinie wird vor 2027 keine kommerziellen Volumina erreichen. Der China Large Fund Phase III stellte 15 Milliarden RMB (2,1 Milliarden USD) für fortschrittliches Packaging bereit, um Engpässe bei führenden Technologieknoten zu beheben, doch das kurzfristige Hemmnis dämpft weiterhin die Wachstumsdynamik des chinesischen GPU-Markts.
*Unsere Prognosen behandeln die Auswirkungen von Treibern und Einschränkungen als richtungsweisend und nicht additiv. Die Wirkungsprognosen berücksichtigen Basiswachstum, Mischungseffekte und Wechselwirkungen zwischen Variablen.
Segmentanalyse
Nach Integrationstyp: Diskrete GPUs dominieren die Rechenzentrumsausgaben
Diskrete Beschleuniger kontrollierten im Jahr 2025 65,73 % des Marktanteils im chinesischen GPU-Markt und werden voraussichtlich bis 2031 mit einer CAGR von 19,88 % wachsen. Nahezu alle Hyperscaler-Trainingscluster nutzen Hochbandbreitenspeicher und dedizierte Interconnects – Merkmale, die in integrierten Lösungen nicht verfügbar sind –, was das Umsatzgewicht diskreter Siliziumlösungen im chinesischen GPU-Markt stärkt. Alibabas Meilenstein von 470.000 Zhenwu-810E-Einheiten im Februar 2026 unterstreicht den Skalenvorteil rack-fähiger Karten. ByteDance spiegelte diesen Trend wider, indem es sein Budget von 14 Milliarden USD fast ausschließlich für diskrete H20- und A800-Boards einsetzte, während Tencent den Großteil seines KI-Budgets von 5 Milliarden USD für ähnliche Rack-Konfigurationen reservierte.
Integrierte GPUs hingegen gewannen im mobilen Ökosystem an Bedeutung. MediaTeks Dimensity 8500, der im Januar 2026 eingeführt wurde, brachte Hardware-Raytracing in Mittelklasse-Smartphones, und Qualcomms Snapdragon 8 Gen 4 brachte Adreno-850-Grafik in Premium-Handsets.[3]MediaTek Pressemitteilung, "Dimensity 8500 bringt Raytracing in Mittelklasse-Smartphones," mediatek.com Integriertes Silizium erfasste einen erheblichen Anteil der Stücklieferungen, hielt jedoch die Größe des chinesischen GPU-Markts in Richtung diskreter Komponenten geneigt. Business-Laptops nutzen integrierte Kerne zur Senkung der Beschaffungskosten, doch Rechenzentrums-Deployments bleiben zu mehr als 95 % diskret, da integrierte GPUs nicht die für das Training großer Sprachmodelle erforderliche Speicherbandbreite liefern können.
Nach Geräteanwendung: Server und Rechenzentrumsbeschleuniger führen das Wachstum an
Server und Rechenzentrumsbeschleuniger machten im Jahr 2025 32,74 % des Umsatzes aus und werden voraussichtlich bis 2031 eine CAGR von 19,94 % erzielen – die schnellste Wachstumsdynamik im chinesischen GPU-Markt. Alibabas und China Telecoms Cluster in Guangdong mit 10.000 Karten veranschaulicht die Größenordnung: Er erreicht 1,2 Exaflops FP16-Rechenleistung und verdeutlicht die Einführung von Flüssigkühlung. Hangzhous kommunaler Vertrag über 100.000 Karten bis Mitte 2026 festigt Server weiter als Nachfragekern. Baidu und Huawei nutzen Kunlunxin- und Ascend-Silizium, um Nvidia-basierte Cloud-Preise um bis zu 30 % zu unterbieten, und gewinnen 70 % des GPU-as-a-Service-Segments.
PCs und Workstations bilden den zweitgrößten Anwendungsbereich, gestützt durch starke Nachfrage von Kreativprofis. NVIDIAs workstationorientierte RTX 6000D, die Anfang 2026 veröffentlicht wurde, richtet sich an CAD- und Simulationsanwender, die eine kontinuierliche inländische Versorgung suchen.[4]Nvidia Corporation, "RTX 6000D Workstation GPU Datenblatt," nvidia.com Die Einführung von Automotive ADAS beschleunigt sich: Xpengs Turing-Chip liefert 750 TOPS, und NIO's Shenji NX9031 überschreitet 1.000 TOPS; zusammen wurden bis Anfang 2026 mehr als 460.000 Fahrzeuge damit ausgestattet. Obwohl Spielkonsolen und Handheld-Geräte eine Nische bleiben, sind industrielle Bildverarbeitung und Smart-City-Geräte aufkommende Standbeine für stromsparende inländische GPUs.
Notiz: Segmentanteile aller Einzelsegmente sind nach dem Berichtskauf verfügbar
Geografische Analyse
Im Jahr 2025 konzentrierten sich Rechenzentrums-Deployments stark auf Peking, Hangzhou und Shenzhen. Diese Städte profitierten von der Nähe zu talentreichen Hauptquartieren und Hochbandbreiten-Backbones. Östliche Provinzen wie Zhejiang, Jiangsu und Guangdong stellten Grundstücke und erneuerbare Energie bereit, gestützt durch provinzielle Subventionen, was die Gesamtbetriebskosten verbesserte. Insbesondere Guangdong leistete erhebliche Finanzierungsbeiträge für Chip-Meilensteinprogramme. Während die Innere Mongolei und Guizhou Strom zu wettbewerbsfähigen Preisen anboten und damit Hyperscaler trotz Latenzproblemen anzogen, begrenzten Netzengpässe deren Anteil.
Shanghais Anreiz eines Stromrabatts für Nutzer inländischer GPUs zog erfolgreich Biren und Moore Threads an, Produktionszentren in Pudong einzurichten, was einen Clustertrend im Yangtze-Flussdelta verstärkte. Unterdessen sicherten sich Tier-2-Städte wie Chengdu, Xi'an und Wuhan einen Anteil der Lieferungen durch Grundstückszuschüsse und Steuerbefreiungen. Anhaltende Fachkräftemangel verlangsamten jedoch die Migration von Knoten. Im Automobilsektor konzentrierte sich die Silizium-Nachfrage auf Guangdong, Shanghai und Anhui, entsprechend den Standorten der BYD-, NIO- und XPeng-Werke. Gaming-GPUs verzeichneten den höchsten Verbrauch in Tier-1-Städten, insbesondere dort, wo das Pro-Kopf-Einkommen höher war und Esports-Arenen zahlreich vorhanden waren.
Im Jahr 2025 repräsentierten die westlichen Provinzen Xinjiang, Qinghai und Gansu einen kleineren Anteil der GPU-Deployments. Angetrieben durch Mandate für erneuerbare Energien entstehen neue solarbetriebene Cluster. Ein Beispiel hierfür ist Baidus Installation von Kunlunxin-Einheiten in Ningxia, das ein bemerkenswertes Verhältnis von Stromverbrauch zu Effizienz aufweist. Mit verbesserter Glasfaserdichte und entspannteren Latenzanforderungen für Inferenzaufgaben sind diese westlichen Regionen bereit, einen größeren Anteil zu gewinnen, ohne jedoch die küstennahen Wirtschaftszentren zu überschatten.
Wettbewerbslandschaft
Zwischen 2024 und 2026 entwickelte sich der einst von ausländischen Anbietern dominierte chinesische GPU-Markt zu einem Schlachtfeld für inländische Akteure. NVIDIAs Marktanteil sank erheblich. Gleichzeitig traten mehr als 15 lokale Anbieter in den Markt ein. Börsengänge von Unternehmen wie Moore Threads, Biren, Muxi, Iluvatar CoreX und Kunlunxin stellten Kapital für Software-Stacks bereit, mit Fokus auf die Überbrückung der CUDA-Kompatibilitätslücke. Alibaba lenkte einen Teil seiner Chip-Beschaffung im Jahr 2025 auf inländische Quellen um. Tencent plant bis 2027 eine ausgewogene Aufteilung. Diese Manöver unterstreichen einen wachsenden Trend zur Dual-Sourcing-Strategie als Risikomanagementmaßnahme.
Aufstrebende Anbieter differenzieren sich durch Cluster-Level-Pakete, die Orchestrierung und Kühlung bündeln. Moore Threads gewann im März 2026 einen schlüsselfertigen Auftrag über 660 Millionen CNY (91 Millionen USD), was den Käuferappetit für integrierte Stacks signalisiert. Xiwang, aus SenseTime hervorgegangen, und Cambricon sind Pioniere bei inferenzoptimierten INT4- und INT8-Komponenten, um eine inländische Token-Last zu bedienen, die nun das doppelte US-Volumen erreicht.
Patentaktivitäten unterstützen diesen Schwung: Anmeldungen für GPU-bezogene Erfindungen stiegen im Jahr 2025 um 42 %, wobei Huawei, Alibaba und Biren mehr als ein Drittel der Anmeldungen ausmachten.[5]Chinesische Nationale Verwaltung für geistiges Eigentum, "Jährliche Patentstatistik 2025," cnipa.gov.cn Speicherinnovation bleibt ein Wettbewerbsfeld: Cambricon setzt auf 64 GB HBM2e, während Tianshu Zhixin kostengünstiges GDDR6X nutzt, um Segmente mit niedrigerem Durchschnittspreis anzusprechen.
Marktführer der chinesischen GPU-Branche
-
NVIDIA Corporation
-
Advanced Micro Devices, Inc.
-
Intel Corporation
-
Huawei Technologies Co., Ltd. (HiSilicon)
-
Biren Technology
- *Haftungsausschluss: Hauptakteure in keiner bestimmten Reihenfolge sortiert
Jüngste Branchenentwicklungen
- April 2026: Alibaba T-Head erhöhte die Preise für den Zhenwu 810E um bis zu 34 % unter Berufung auf anhaltende Versorgungsengpässe und bestätigte die Auslieferung von 470.000 Einheiten bis Februar 2026.
- März 2026: Moore Threads gewann einen KI-Cluster-Auftrag über 660 Millionen CNY, der Hardware, Kühlung und mehrjährigen Support für Unternehmenskunden bündelt.
- März 2026: Muxi ging eine Partnerschaft mit DuoDian Shuzhi ein, um GPU-gestützte Einzel-KI in 5.000 Filialen landesweit einzuführen.
- März 2026: Muxi sicherte sich 550 Millionen RMB zur Skalierung der Edge-Inferenz-GPU-Produktion.
Berichtsumfang des chinesischen GPU-Markts
Der Bericht zum chinesischen GPU-Markt ist segmentiert nach Integrationstyp (Integrierte GPUs und Diskrete GPUs) sowie nach Geräteanwendung (Mobile Geräte und Tablets, PCs und Workstations, Server und Rechenzentrumsbeschleuniger, Spielkonsolen und Handheld-Geräte, Automotive und ADAS sowie andere eingebettete und Edge-Geräte). Die Marktprognosen werden in Wertangaben (USD) bereitgestellt.
| Integrierte GPUs (iGPU) |
| Diskrete GPUs (dGPU) |
| Mobile Geräte und Tablets |
| PCs und Workstations |
| Server und Rechenzentrumsbeschleuniger |
| Spielkonsolen und Handheld-Geräte |
| Automotive / ADAS |
| Andere eingebettete und Edge-Geräte |
| Nach Integrationstyp | Integrierte GPUs (iGPU) |
| Diskrete GPUs (dGPU) | |
| Nach Geräteanwendung | Mobile Geräte und Tablets |
| PCs und Workstations | |
| Server und Rechenzentrumsbeschleuniger | |
| Spielkonsolen und Handheld-Geräte | |
| Automotive / ADAS | |
| Andere eingebettete und Edge-Geräte |
Im Bericht beantwortete Schlüsselfragen
Welchen prognostizierten Wert wird der chinesische GPU-Markt im Jahr 2031 erreichen?
Der Markt wird voraussichtlich bis 2031 einen Wert von 117,91 Milliarden USD erreichen.
Wie schnell wird der Markt zwischen 2026 und 2031 voraussichtlich wachsen?
Es wird prognostiziert, dass er in diesem Zeitraum mit einer CAGR von 19,21 % wächst.
Welches Segment hielt im Jahr 2025 den größten Anteil?
Diskrete GPUs führten im Jahr 2025 mit 65,73 % des Marktumsatzes.
Welche Anwendungskategorie wird das schnellste Wachstum verzeichnen?
Server und Rechenzentrumsbeschleuniger werden voraussichtlich bis 2031 mit einer CAGR von 19,94 % wachsen.
Wie wirken sich Exportkontrollen auf Anbieter aus?
US-Beschränkungen reduzierten den Zugang zu High-End-GPUs, was Anbieter dazu veranlasste, abgespeckte Versionen zu entwickeln, und chinesische Käufer dazu brachte, sich stärker auf inländische Chips zu diversifizieren.
Warum investieren Cloud-Betreiber in Binnenprovinzen?
Niedrigere Strompreise und Mandate für erneuerbare Energien machen Regionen wie die Innere Mongolei und Guizhou trotz Latenz-Kompromissen für große Cluster attraktiv.
Seite zuletzt aktualisiert am: