Blog
Veraltet die Technik nicht schnell?
Warum Arztpraxen jetzt in eigene Infrastruktur investieren sollten.
Viele Praxen zögern bei lokaler KI aus einem verständlichen Grund: Technik werde ohnehin schnell veraltet. Aktuell beobachten wir sogar das Gegenteil: Hardware wird immer mehr wert. Chips und Speicher werden teurer – aus Gründen, die voraussichtlich auch in den nächsten Jahren anhalten.
1. Die Nachfrage explodiert
Weltweit kaufen riesige Datenzentren (sog. Hyperscaler) enorme Mengen an GPUs und Speicher auf. Der Wettbewerb um leistungsfähige Hardware treibt die Preise weiter nach oben.[1][2]
Die RTX 5090 gibt es erst seit Januar 2025 – zu kurz für eine Fünfjahreskurve. Deshalb zeigen wir die NVIDIA GeForce RTX 4090: das vorherige Flagship, das seit dem Launch 2022 teurer geworden ist statt günstiger.
2. Die Produktionskapazität bleibt eng
Weder Stromnetze noch die Fertigung hochmoderner Chips lassen sich selbst mit grossen Investitionen beliebig ausweiten. Laut der IEA stehen Netze bereits unter Druck; rund 20 % geplanter Datencenter-Projekte drohen Verzögerungen.[5]
Moderne Chips brauchen zudem EUV-Maschinen – und die kann weltweit nur eine Firma herstellen. Diese Engpässe bleiben mindestens bis Ende des Jahrzehnts relevant.[6]
3. Modelle werden laufend besser
Software und Laufzeitumgebungen werden effizienter; dadurch kann dasselbe System mit der Zeit sogar leistungsfähigere Aufgaben übernehmen. Heute erreichen Modelle mit deutlich weniger aktivem Rechenaufwand oft das, wofür früher deutlich grössere Modelle nötig waren – etwa durch:
- Mixture-of-Experts – nur ein Teil der Parameter wird pro Anfrage aktiv[7]
- Sparsame Attention-Verfahren wie Sliding Window Attention – weniger Aufwand bei langen Texten[8]
- Grouped-/Multi-Query-Attention – weniger Speicher und Bandbreite[9]
- Quantisierung – gleiche Fähigkeit bei kleinerem Speicherbedarf[10]
Bessere Trainingsdaten und Destillation verstärken diesen Trend zusätzlich.
Für den Praxisalltag zählt nicht der letzte Index-Punkt: Modelle, die auf einer 32-GB-Klasse laufen, erreichen die Cloud-Frontier typischerweise mit wenigen Monaten Abstand. Qwen3.8 27B (Aug. 2026) liegt auf dem Artificial Analysis Intelligence Index gleichauf mit GPT-5.6 Luna – lokal, ohne Cloud.[11][12]
Was das für Ihre Praxis bedeutet
Aufgrund dieser Entwicklungen bemisst sich der Wert einer GPU immer weniger daran, wie neu sie ist – sondern daran, wie viel Zeit und Kosten sie den Nutzenden spart. Läuft in Ihrer Praxis ein lokales System, das den Job zuverlässig erledigt, spielt es nicht unbedingt eine Rolle, ob es in Zukunft noch leistungsfähigere Hardware gibt.
Wir dimensionieren Ihr System mit Reserven und setzen auf erweiterbare, aktualisierbare Komponenten.
Viele grosse Firmen – inklusive Spitäler – investieren deshalb jetzt in Hardware. Auch Arztpraxen sollten hier nicht aussen vor bleiben: Ein früherer Einstieg sichert leistungsfähige Technik und schützt vor weiteren Preissteigerungen.
Cloud ist oft subventioniert – und wird teurer
Ein weiteres Problem: Cloud-Angebote sind derzeit oft stark subventioniert, der In-House-Compute-Bedarf der Anbieter, um noch bessere Modelle zu trainieren, steigt gleichzeitig weiter. Frontier-/AGI-Entwicklung wird zum Teil vor Inferenz priorisiert,[13] und Flat-rate-/Token-Subventionen werden zunehmend zurückgenommen.[14] In Zukunft ist deshalb mit deutlichen Preisanstiegen bei Cloud-Anbietern zu rechnen.
Lokale Infrastruktur kehrt dieses Risiko um: Einmal investiert, bleibt die Kapazität in Ihrer Praxis – unabhängig von fremden Preislisten und Kapazitätsengpässen.
Quellen
- Reuters: Chip crunch and memory prices
- J.P. Morgan: AI-driven DRAM shortage
- Tom’s Hardware: RTX-4090-Preisanstieg 2023
- GPU PRIX: GeForce RTX 4090, Stand 20. August 2026
- IEA: Energy and AI, Executive Summary
- Enverus: ASML EUV as a limit on the AI buildout
- Mixtral of Experts (arXiv:2401.04088)
- Mistral 7B, Sliding Window Attention (arXiv:2310.06825)
- Grouped-Query Attention (arXiv:2305.13245)
- AWQ: Activation-aware Weight Quantization (arXiv:2306.00978)
- r/LocalLLaMA: The local frontier is now smarter than Sonnet 4.5 (AA Intelligence Index v4.1.1, Cloud vs. Local Frontier)
- Artificial Analysis: Qwen3.8 27B (Index 52, 14. Aug. 2026) · Intelligence Index v4.1.1
- Alphabet: Compute-Priorität Frontier/AGI vor Cloud-Kunden
- Analyse zum Ende der Token-Subventionen