Zum Inhalt springen

Technik-Datenblatt

Modelle & Hardware

Ihr Modell entsteht durch Feintuning eines offenen Basismodells der Qwen3.5-Reihe, von Grund auf in 4-Bit-Präzision (NVFP4) trainiert.

M

Basismodell: Qwen3.5-9B

Ausgewogener Standard für die meisten Fachbereiche: breitere Wissensbasis, differenziertere Antworten.

Was es realistisch kann

Das 9B-Modell ist die Empfehlung, wenn ein Modell mehrere Themen und Abteilungen abdecken soll. Es fasst längere Dokumente zusammen, verfasst E-Mails, Angebote und interne Texte im Stil Ihres Unternehmens und beantwortet Fragen über eine größere Wissensbasis (bis ca. 60.000 Seiten), auch bei Nuancen und mehrdeutigen Fragen. Stabiles Firmenwissen unterscheidet es dabei von tagesaktuellen Werten: Preise, Bestände oder Kontaktdaten behauptet es nicht; es verweist auf die verlässliche Quelle. Grenzen: Für sehr große Wissensbasen oder besonders analytische Aufgaben ist das 27B die richtige Wahl.

L

Basismodell: Qwen3.5-27B

Das größte Modell, für große Wissensbasen und anspruchsvolle Fragen.

Was es realistisch kann

Das 27B-Modell ist für Unternehmen gedacht, die viel Wissen bündeln und hohe Antwortqualität brauchen. Es arbeitet über sehr große Dokumentenbestände (bis ca. 120.000 Seiten) und hält dank eines nativen Kontexts von 262.000 Token auch sehr lange Dialoge und Dokumente zusammen; es deckt 201 Sprachen ab. Es eignet sich für Aufgaben, bei denen eine Antwort mehrere Zusammenhänge verbinden muss. Grenzen: Es ist auf Ihr Wissen fokussiert, kein universelles Modell wie die großen Cloud-Dienste; dafür läuft es vollständig lokal und gehört Ihnen. Der Hardwarebedarf ist am höchsten.

Gilt für beide Modelle: direkt in NVFP4 (4 Bit) feingetunt, sodass es in derselben Präzision auf Ihrer Hardware läuft, und auf Apache-2.0-Basis mit voller Rechteübertragung samt Eigentumszertifikat.

Empfohlene Hardware

Die Hardware beschaffen Sie selbst. Verfügbarkeit und Preise am Markt schwanken derzeit stark; statt Sie an ein bestimmtes Gerät oder einen Preis zu binden, überlassen wir Ihnen die Wahl. Die folgenden NVIDIA-Systeme dienen als Orientierung; unser Einrichtungsprogramm prüft Ihre Hardware und wählt den passenden Pfad für Ihr Modell.

NVIDIA DGX Spark

Empfehlung

GB10 Grace-Blackwell-Superchip

Unsere Empfehlung für die meisten: kompakt wie ein Buch, leise, steht im Regal und trägt Ihr feingetuntes Modell mit Reserven.

KI-Leistung
bis 1 PetaFLOP (FP4)
Speicher
128 GB einheitlich (CPU + GPU, LPDDR5X)
Prozessor
20 Arm-Kerne (GB10)
Gleichzeitige Nutzer
kleine Teams, ca. 5–15 aktive Chats flüssig
Massenspeicher
4 TB NVMe
Netzwerk
10 GbE, WLAN 7, ConnectX-7 (200 Gb/s)
Mehrbenutzer
eine gemeinsame Instanz
Format
150 × 150 × 50,5 mm, ca. 1,1 Liter

NVIDIA DGX Station

Mehr Compute

GB300 Grace-Blackwell-Ultra-Superchip

Für deutlich mehr Compute: mehrere Teams, größere Modelle, ein Gerät. Rechenzentrums-Klasse als Tower unter dem Schreibtisch.

KI-Leistung
bis 20 PetaFLOPS (FP4)
Speicher
748 GB kohärent (inkl. HBM3e-GPU-Speicher)
Prozessor
72-Kern NVIDIA Grace
Gleichzeitige Nutzer
ganze Abteilungen, 100+ aktive Chats flüssig
Massenspeicher
NVMe-SSD, konfigurationsabhängig
Netzwerk
ConnectX-8, bis 800 Gb/s
Mehrbenutzer
bis 7 getrennte Instanzen (MIG)
Format
Tower, flüssigkeitsgekühlt

Nutzerangaben: gleichzeitig aktive Chats bei unseren Modellgrößen (9B–27B), konservativ geschätzt. Die Systeme dienen als Orientierung; die Hardware beschaffen Sie selbst.

IonKon · Ihr eigenes KI-Modell