🇩🇪 Soofi S – Europas stärkstes quelloffenes KI-Modell kommt aus Deutschland
🧐 Was ist passiert?
Ein deutsches Forschungskonsortium, koordiniert vom KI Bundesverband, hat mit Soofi S ein vollständig offenes Sprachmodell veröffentlicht. Trainiert wurde es komplett auf der Industrial AI Cloud der Deutschen Telekom in München – einer der ersten großen Trainingsläufe dort. Unter vollständig offenen Modellen erreicht Soofi S 30B-A3B die höchsten Werte auf deutschen und englischen Benchmarks und übertrifft dabei Olmo 3 32B des Allen Institute sowie Apertus 70B von ETH und EPFL.
🔐 Schlüsselpunkte
• Mixture-of-Experts mit 31,6 Mrd. Parametern, aber nur ~3,2 Mrd. aktiv pro Token – Rechenkosten näher an 3B als an 30B
• Trainiert auf ~27 Billionen Token in drei Phasen mit hohem Deutsch-Fokus – bis zu 15,3 Prozent gegenüber Nemotrons 5 Prozent
• Beste Open-Source-Werte bei Code – HumanEval 73,8 Prozent, MBPP 70,2, deutsche MBPP-Variante 84,2
• Trainiert März bis Mai auf bis zu 512 Nvidia-B200-GPUs, rund 253.000 GPU-Stunden, vollständig mit erneuerbarer Energie
• Erfüllt die Open Source AI Definition der OSI, verfehlt aber die strengere europäische Open-Data-Definition wegen lizenziertem Genios-Anteil
🤔 Warum ist das für dich relevant?
Soofi S zeigt, dass ein europäisches Konsortium auf souveräner Infrastruktur ein offenes Modell bauen kann, das mit internationalen Open-Weight-Systemen mithält – und dabei jede europäische souveräne Baseline auf deutschen Benchmarks schlägt. Der niedrige Rechenaufwand macht es besonders effizient im Betrieb. Gleichzeitig bleiben Schwächen bei Wettbewerbsmathematik und offener Faktenabfrage, was Hauptautor Michael Fromm auf die nur 3,2 Mrd. aktiven Parameter zurückführt. Er verortet das Modell zwischen breit multilingualen EU-Projekten wie EuroLLM und Teuken und den stärksten internationalen Open-Weight-Modellen.
Webseite: www.soofi.info/soofi-s/
Weitere Infos: auf heise.de https://the-decoder.de/deutsches-konsortium-veroeffentlicht-offenes-ki-modell-soofi-s-fuer-deutsch-und-englisch/