[
  {
    "start": 0.0,
    "end": 1.34,
    "text": "Willkommen bei Promtzeit."
  },
  {
    "start": 1.6,
    "end": 4.1,
    "text": "Wir kommen fast für KI in der Unternehmenswelt,"
  },
  {
    "start": 4.46,
    "end": 5.66,
    "text": "von Hardware bis Recht"
  },
  {
    "start": 5.98,
    "end": 8.5,
    "text": "Praxisner Deutschsprachig Von dir."
  },
  {
    "start": 9.44,
    "end": 10.06,
    "text": "Es geht los!"
  },
  {
    "start": 14.52,
    "end": 15.4,
    "text": "Bevor es losgeht."
  },
  {
    "start": 15.56,
    "end": 21.14,
    "text": "ein Hinweis in eigener Sache Bei Promt Zeit ist die KI nicht nur Thema sondern macht auch die Arbeit."
  },
  {
    "start": 21.68,
    "end": 25.7,
    "text": "Stimmen, Recherche und Redaktion dieses Podcasts sind KI generiert."
  },
  {
    "start": 26.38,
    "end": 28.58,
    "text": "In diesem Sinne viel Spaß mit Erfolge."
  },
  {
    "start": 30.4,
    "end": 33.14,
    "text": "DGX Spark schrägstrich GB-X."
  },
  {
    "start": 34.36,
    "end": 44.44,
    "text": "Vor zwei Jahren war lokale KI-Inferenz für den Mittelstand entweder ein Eigenbauprojekt mit drei H-Einhundertkarten und Serverschrank oder gar keine Option."
  },
  {
    "start": 45.24,
    "end": 55.74,
    "text": "Mit dem Gb-X Grace Blackwell Superchip hat NVIDIA twenty-fünfundzwanzig eine Geräteklasse aufgemacht, die in den Werkraum eines mittelständischen Unternehmens passt."
  },
  {
    "start": 56.58,
    "end": 62.36,
    "text": "Einhundert achtundzwantig Gigabyte Unified Memory unter Zweihundertvierzig Wattaufnahme."
  },
  {
    "start": 62.98,
    "end": 67.9,
    "text": "Listenpreis Viertausend Fünfhundert bis Viertausend Achthundert Euro pro Gerät."
  },
  {
    "start": 68.86,
    "end": 85.1,
    "text": "Vertrieben unter eigener Marke als Nvidia DGX Spark, gleichzeitig als OEM-Variante von ASUS unter dem Namen Ascent GX X. Beide tragen denselben Chip haben dasselbe Memory Subset leisten technisch das gleiche!"
  },
  {
    "start": 86.04,
    "end": 90.46,
    "text": "Was diese Klasse heute leistet, wofür sie passt und wo ihre Grenzen liegen."
  },
  {
    "start": 91.0,
    "end": 92.04,
    "text": "Eine Bestandsaufnahme!"
  },
  {
    "start": 93.62,
    "end": 94.1,
    "text": "Der Chip."
  },
  {
    "start": 94.76,
    "end": 97.06,
    "text": "Warum die Architektur den Unterschied macht?"
  },
  {
    "start": 98.52,
    "end": 109.82,
    "text": "Der GB-X ist ein Superchip – Ein System on chip in dem CPU, GPU und RAM auf einem einzigen Substrat sitzen und sich denselben Speicher teilen."
  },
  {
    "start": 110.68,
    "end": 114.18,
    "text": "Das ist der entscheidende Unterschied zu klassischen Server-GPUs."
  },
  {
    "start": 115.1,
    "end": 122.14,
    "text": "Bei einem H-Einhundert oder A-Einhundertserver bewegt sich die GPU über einen PCIe-Bus."
  },
  {
    "start": 122.66,
    "end": 127.28,
    "text": "Der RAM ist getrennt, jede Datenübertragung ist ein expliziter Schritt."
  },
  {
    "start": 128.24,
    "end": 144.38,
    "text": "Beim GB-X sitzt das Speichersubsystem unter dem gleichen Dach wie die Recheneinheit Unified Memory in der Praxis, onehundert-achtundzwanzig Gigabyte LPDDR VX mit rund zweihundertdrei und siebzig Gigabyte pro Sekunde Bandbreite."
  },
  {
    "start": 145.42,
    "end": 162.12,
    "text": "Das klingt zunächst weniger spektakulär als die drei Terabyte pro sekunde einer H-Einhundert mit HBM III aber im Verhältnis von Leistung zu Stromaufnahme und Preis spielt er GB-Xen in einer eigenen Liga Die Konsequenz?"
  },
  {
    "start": 162.84,
    "end": 174.06,
    "text": "Modelle bis etwa dreißig bis vierzig Milliarden Parameter in Vier-Bit oder FP acht Quantisierung passen vollständig in den Speicher eines einzelnen GB zehn Geräts."
  },
  {
    "start": 174.98,
    "end": 181.54,
    "text": "Größere Modelle laufen über mehrere Geräte im Cluster, was sich im realen Atlas Betrieb stabil umsetzen lässt."
  },
  {
    "start": 182.94,
    "end": 197.48,
    "text": "Anbieter und Verfügbarkeit Die GB zehn Klasse ist im Frühjahr zwei tausend sechsundzwanzig Inzwei Marken Varianten am Markt NVIDIA DGX Spark Eigenmarke des Chip-Herstellers."
  },
  {
    "start": 197.98,
    "end": 203.74,
    "text": "Listenpreis rund US-Dollar, ungefähr €."
  },
  {
    "start": 205.42,
    "end": 213.46,
    "text": "Vertrieb über NVIDia Partner und ausgewählte Distributoren In Deutschland unter anderem Aspis, Bechtle, Pan da komm."
  },
  {
    "start": 214.56,
    "end": 216.96,
    "text": "Lieferzeit typisch zwei bis vier Wochen."
  },
  {
    "start": 217.7,
    "end": 225.32,
    "text": "Service über den jeweiligen Distributor Eignet sich für Häuser, die ohnehin in einer NVIDIA Beschaffungsstruktur arbeiten."
  },
  {
    "start": 226.74,
    "end": 233.2,
    "text": "ASUS Ascent GX-Zen OEM-Variante auf identischer Hardwarebasis."
  },
  {
    "start": 234.06,
    "end": 242.02,
    "text": "Listenpreis rund fourtausend fünfhundert Euro pro Note In Dachchannel über das ASUS Partnernetz und etablierte Systemhäuser."
  },
  {
    "start": 242.24,
    "end": 243.14,
    "text": "breit verfügbar."
  },
  {
    "start": 244.4,
    "end": 244.72,
    "text": "Stärke?"
  },
  {
    "start": 245.5,
    "end": 255.86,
    "text": "Vierundzwanzig sieben Serviceoptionen mit Vorortreaktion durch lokales Systemhaus Eine Struktur, die im Klinik- und Bankumfeldern häufig nachgefragt wird."
  },
  {
    "start": 257.04,
    "end": 263.8,
    "text": "Die getestete Atlaskonfiguration auf den Seiten XXVI bis XXII läuft auf zwei dieser Geräte."
  },
  {
    "start": 264.8,
    "end": 270.52,
    "text": "Beide Geräten sind technisch gleichwertig – die Wahl folgt selten dem Chip, häufiger dem Channel."
  },
  {
    "start": 271.46,
    "end": 275.42,
    "text": "Wer ohnehin mit einem ASUS Vertriebspartner arbeitet bleibt dabei!"
  },
  {
    "start": 276.3,
    "end": 279.68,
    "text": "Wer in einer NVIDIA Direktlinie steht nimmt die Spark."
  },
  {
    "start": 282.76,
    "end": 285.08,
    "text": "Eine dritte Variante wird für H.II."
  },
  {
    "start": 285.1,
    "end": 288.74,
    "text": "... ... von weiteren OEMs erwartet."
  },
  {
    "start": 289.54,
    "end": 292.9,
    "text": "Dell, HPE haben Pilotprogramme angekündigt."
  },
  {
    "start": 293.9,
    "end": 296.58,
    "text": "Die Chipbasis ist in allen Fällen identisch"
  },
  {
    "start": 298.26,
    "end": 300.68,
    "text": "Was die Klasse leistet und was nicht?"
  },
  {
    "start": 302.06,
    "end": 311.84,
    "text": "Die ehrlichste Einschätzung kommt aus dem Vergleich mit den Geräteklassen da rüber und darunter Im Vergleich zu einem Haar-Einhundertserver Rechenzentrumsklasse."
  },
  {
    "start": 312.9,
    "end": 325.8,
    "text": "Eine einzelne H-Einhundertkarte mit Achtzig Gigabyte HBM III liefert in den meisten Inferenzszenarien etwa das drei bis fünffache an Durchsatz wie ein einzelnes GB-Zähngerät."
  },
  {
    "start": 326.76,
    "end": 337.8,
    "text": "Sie kostet aber je nach Konfiguration auch das zehn bis zwanzigfache und braucht einen Rechenzentrum-Server samt Klima, Stromversorgung und IT Operations Team."
  },
  {
    "start": 338.88,
    "end": 345.76,
    "text": "Der GB-Xen ist kein Mini H-Einhundert, er isst eine andere Geräteklasse mit anderem Einsatzzweck."
  },
  {
    "start": 347.4,
    "end": 373.18,
    "text": "Im Vergleich zu klassischen Workstation GPUs RTX A-Sixthausend Elfvierzig S Eine RTX A sixtausend mit achtundvierzicht Gigabyte Speicher ist in Spitzenthroughput etwa gleichwertig zu einem GB-Zen In der Modellkapazität Einhundertundzwanzig Gigabyte Unified Memory beim GB-Zen, aber deutlich unterlegen."
  },
  {
    "start": 374.32,
    "end": 384.08,
    "text": "Wer dreißig Milliarden Parametermodelle lokal fahren will kommt mit klassischen Workstation GPUs an die Speichergrenze – Mit dem GB-zen nicht!"
  },
  {
    "start": 386.0,
    "end": 386.84,
    "text": "Was Nicht geht?"
  },
  {
    "start": 388.24,
    "end": 392.46,
    "text": "Trainingsläufe großer Modelle sind auf dem GB ZEN nicht praktikabel."
  },
  {
    "start": 393.24,
    "end": 396.1,
    "text": "Die Klasse ist eindeutig für Infarenz konzipiert."
  },
  {
    "start": 397.18,
    "end": 405.3,
    "text": "Wer ein eigenes Modell trainieren oder Feintunen will, bleibt bei Cluster-GPUs H.Einhundert B.Zweihundert."
  },
  {
    "start": 406.58,
    "end": 413.68,
    "text": "Auch reasoningintensive Premiummodelle der GPT V Klasse laufen nicht lokal auf der GBX Klasse."
  },
  {
    "start": 414.52,
    "end": 423.32,
    "text": "Dafür reicht die Modellgröße nicht in den Speicher ohne Quantisierungsverluste in Kauf zu nehmen, die für Reasoning-Tasks problematisch werden."
  },
  {
    "start": 427.4,
    "end": 427.48,
    "text": "Die"
  },
  {
    "start": 445.46,
    "end": 450.86,
    "text": "Antworten stehen längst irgendwo im Haus, in alten Angeboten und Referenzlisten."
  },
  {
    "start": 452.78,
    "end": 455.12,
    "text": "Nur eben nicht an nur einer Stelle."
  },
  {
    "start": 458.42,
    "end": 459.74,
    "text": "Sie laden die Unterlagen hoch."
  },
  {
    "start": 460.16,
    "end": 479.78,
    "text": "Tender erkennt die Fragen geht sie einzeln durch und beantwortet sie aus ihrem eigenen Wissensbestand In der Originalnummerierung Im original Wortlaut Zu jeder Antwort sehen Sie, aus welchem Dokument sie stammt und wenn eine Frage offen bleibt sagt Ihnen Tender warum."
  },
  {
    "start": 480.48,
    "end": 484.26,
    "text": "Entweder fehlen die Daten oder ihnen fehlt die Berechtigung."
  },
  {
    "start": 485.36,
    "end": 487.44,
    "text": "Alles läuft auf Ihren eigenen Servern."
  },
  {
    "start": 487.9,
    "end": 489.48,
    "text": "Kein Dokument verlässt Ihr Haus."
  },
  {
    "start": 490.04,
    "end": 493.2,
    "text": "Abgeschickt wird nichts automatisch Die Abgabe."
  },
  {
    "start": 493.62,
    "end": 504.66,
    "text": "entscheiden Sie Ihre Antwort, Ihr"
  },
  {
    "start": 504.92,
    "end": 505.2,
    "text": "Haus."
  },
  {
    "start": 512.1,
    "end": 515.46,
    "text": "Software-Stack und Reifegrad."
  },
  {
    "start": 515.5,
    "end": 521.4,
    "text": "Die GB-X-Klasse läuft auf Ehach-六zig Linux Ubuntu RHEL."
  },
  {
    "start": 522.179,
    "end": 526.22,
    "text": "Das ist die kleinere Software-Hürde, die in der Planung gerne übersehen wird."
  },
  {
    "start": 527.14,
    "end": 532.08,
    "text": "Manche kommerzielle Inferenz-Engines unterstützen Ahch- vierundsechzig noch nicht voll."
  },
  {
    "start": 532.8,
    "end": 537.24,
    "text": "Manche Precompiled-Kernel sind nur für X- sechsund achtzig verfügbar."
  },
  {
    "start": 538.22,
    "end": 547.94,
    "text": "Die ausgereifte Open-Source-Welt VLLM Lama.CPP OLAMA TGI läuft stabil auf der Plattform."
  },
  {
    "start": 548.84,
    "end": 564.6,
    "text": "VLLm, die im Mittelstand am häufigsten gewählte Inferenz-Engine ist seit Version Null.Xen.Zwei mit nativer AHRCH-IV Unterstützung und Hermes Tool Calling auf der Platform stabil produktiv einsetzbar."
  },
  {
    "start": 565.7,
    "end": 572.76,
    "text": "Bestimmte Quantisierungspfade, etwa Pre-Compiled FP-Acht sind auf ARCH-IV noch nicht vollständig."
  },
  {
    "start": 573.32,
    "end": 576.8,
    "text": "Werden aber durch dynamische Quantisierung zur Laufzeit aufgefangen!"
  },
  {
    "start": 578.02,
    "end": 583.08,
    "text": "Wer eine offene Plattform fahren will hat den vollständigen Stack heute zur Verfügung."
  },
  {
    "start": 584.02,
    "end": 591.02,
    "text": "Wer eine kommerzielle Inferenz Engine bevorzugt sollte vor dem Kauf die ARCH IV verfügbarkeit prüfen."
  },
  {
    "start": 593.0,
    "end": 599.92,
    "text": "Was die Klasse für den Mittelstand bedeutet Die GBC-Klasse hat das Spielfeld verschoben."
  },
  {
    "start": 601.12,
    "end": 612.66,
    "text": "Vor zwei Jahren bedeutete lokale KI im Mittelstand eine sechsstellige Hardware-Investition, einen klimatisierten Serverraum und ein dediziertes ML Ops Team."
  },
  {
    "start": 613.88,
    "end": 622.86,
    "text": "Heute steht in derselben Investitionsklasse eines mittelgroßen Office-Drucker Parks – ein produktiv nutzbares Inferenzsetup auf dem Schreibtisch."
  },
  {
    "start": 624.12,
    "end": 626.78,
    "text": "Was die nächsten Generationen bringen ist absehbar!"
  },
  {
    "start": 627.86,
    "end": 632.24,
    "text": "Nvidia hat für twenty-sevenundzwanzig eine Nachfolgerklasse angekündigt."
  },
  {
    "start": 633.06,
    "end": 640.62,
    "text": "Weitere OEMs werden im Lauf des Jahres in das Segment einsteigen, aber die Kernbotschaft steht heute!"
  },
  {
    "start": 641.88,
    "end": 654.02,
    "text": "Wer eine Pilotplattform für fünfzig bis dreihundert Nutzer aufsetzen will kommt nicht mehr an der Frage vorbei ob er das in der Cloud oder lokal auf einem oder zwei kompakten Geräten tut."
  },
  {
    "start": 655.44,
    "end": 662.26,
    "text": "Der Cluster-Test auf den nächsten beiden Seiten zeigt, was diese Geräte in einer realen Editorial Pipeline leisten."
  },
  {
    "start": 686.58,
    "end": 692.44,
    "text": "Ein einzelner GB-Zähn trägt das ohne Klimakammer und ohne dedizierte Stromversorgung."
  },
  {
    "start": 693.42,
    "end": 698.24,
    "text": "Investition für Gerät plus Software-Stack – fünftausend bis achttausende Euro."
  },
  {
    "start": 699.04,
    "end": 700.96,
    "text": "Pilotzeit drei bis sechs Wochen."
  },
  {
    "start": 702.96,
    "end": 724.58,
    "text": "Zwei Note Cluster für gemischte Workloads Ein Fast Tier mit kompakterem Modell etwa sieben bis neun B-Parameter Für leichte Klassifizierungs- und Extraktionsaufgaben ein Heavy-Tier mit einem größeren MOE-Modell etwa dreißig B für anspruchsvolle Reasoning und Generierungsstages."
  },
  {
    "start": 725.78,
    "end": 740.28,
    "text": "Diese Konfiguration trägt mittlere Produktivlasten bis etwa dreihundert Nutzer in einem reinen Büroarbeitsszenario oder eine fortlaufende Editorial Pipeline wie auf den Seiten sechsundzwanzig bis siebenundzwantzig dokumentiert."
  },
  {
    "start": 741.42,
    "end": 745.8,
    "text": "Investition Achttausendfünfhundert bis Zehntausendeuro für die Hardware."
  },
  {
    "start": 747.92,
    "end": 760.86,
    "text": "Mehr Note-Cluster für größere Häuser, vier bis acht Geräte mit Load Balancing Front, HA Proxy oder Ähnliches decken Produktivsetups mit mehreren parallelen Workloads ab."
  },
  {
    "start": 761.92,
    "end": 771.9,
    "text": "Ab dieser Größe lohnt die Auseinandersetzung mit der Frage ob nicht doch ein Rechenzentrumserver mit einer oder zwei H-Einhundertkarten effektiver ist?"
  },
  {
    "start": 772.92,
    "end": 778.1,
    "text": "Die TCO-Kreuzung liegt typischerweise bei vier bis sechs GBZ-Notes."
  },
  {
    "start": 778.3,
    "end": 782.36,
    "text": "Das war's wieder für heute und wir hoffen, Sie konnten etwas Nützliches aus der Folge ziehen!"
  },
  {
    "start": 783.04,
    "end": 784.04,
    "text": "Wir das sind Ella..."
  },
  {
    "start": 784.7,
    "end": 785.5,
    "text": "...und Helmut."
  }
]