Aleph AlphaTFree-HAT-Pretrained-7B-BaseStand: Juli 2026

Aleph Alpha TFree-HAT

Steckbrief

Aktuelle Version
TFree-HAT-Pretrained-7B-Base
Kontextfenster
32K Token
Modalitäten
Text
Preisniveau
Günstig
Release
August 2025
Anbieter
Aleph Alpha (Deutschland)
Weights
Hybrid
Lizenz
Open Aleph License (nicht-kommerzielle Nutzung der offenen TFree-HAT- und Pharia-1-Gewichte) + proprietäre Lizenz für kommerziellen Einsatz
AVV
Ja, für Cloud- und Hybrid-Bereitstellungen über PhariaAI/STACKIT abschließbar; bei vollständigem Self-Hosting im eigenen Rechenzentrum entfällt der AVV-Bedarf mangels Drittbeteiligung
EU-Hosting
PhariaAI Self-Hosting im eigenen Rechenzentrum (On-Premise), STACKIT — souveräne Cloud von Schwarz Digits, Rechenzentren in Deutschland/Österreich, BSI-C5-testiert, Hybride Bereitstellung (On-Premise kombiniert mit STACKIT-Cloud)

Details zur gesamten Familie: Zur Aleph Alpha-Übersicht.

Die Modell-Landschaft ändert sich monatlich.

Wir benachrichtigen Sie, wenn sich dieser Steckbrief ändert — neue Modelle, Kontextfenster, EU-Hosting oder DSGVO-Status.

Unregelmäßig, nur bei relevanten Änderungen. Jederzeit abbestellbar. Mit der Anmeldung willigen Sie ein, E-Mail-Benachrichtigungen über Änderungen an unseren KI-Modell-Daten zu erhalten. Details in der Datenschutzerklärung.

TFree-HAT-Pretrained-7B-Base ist das aktuelle offene Flaggschiff von Aleph Alpha und markiert die Umbenennung der offenen Modelllinie von "Pharia" zu "TFree-HAT". Es handelt sich um ein rund 7-Milliarden-Parameter-Modell, das am 20. August 2025 vorgestellt und von Grund auf neu auf englischen und deutschen Daten trainiert wurde. Die Besonderheit liegt in der Architektur: Der Hierarchical Autoregressive Transformer (HAT) arbeitet tokenizer-frei und verbindet eine zeichenweise Kodierung und Dekodierung mit einem wortbasierten Backbone. Damit entfällt der klassische feste Token-Vokabular-Schritt, was laut Aleph Alpha eine bessere Textkompression, höhere Robustheit gegenüber Eingabevariationen und eine leichtere Anpassung an neue Sprachen und Fachdomänen über Fine-Tuning ermöglicht.

Das Modell verarbeitet reinen Text und wurde auf ein Kontextfenster von rund 32.000 Token angepasst — ein deutlicher Sprung gegenüber den 8.192 Token der Pharia-1-Generation. Die Trainingsdaten wurden nach eigenen Angaben unter Berücksichtigung von EU- und nationalen Vorschriften einschließlich Urheber- und Datenschutzrecht kuratiert, was die Ausrichtung auf KI-Souveränität und regulierte Branchen unterstreicht. Die Gewichte stehen als open-weights unter der Open Aleph License bereit — ausdrücklich für nicht-kommerzielle Forschungs- und Bildungszwecke; kommerzieller Einsatz erfordert eine gesonderte Vereinbarung. Für den produktiven Betrieb setzt Aleph Alpha auf Self-Hosting im eigenen Rechenzentrum oder in der souveränen STACKIT-Cloud. Ergänzend existiert mit Llama-TFree-HAT-Pretrained-7B-DPO eine nachtrainierte DPO-Variante aus derselben Ankündigung.

Welches Modell trägt Ihre Use Cases — und was kostet der Betrieb?

In der KI-Strategie-Beratung erhalten Sie eine konkrete Modell-Empfehlung entlang Ihrer Use Cases: Hosting-Pfad von EU-Cloud bis Self-Hosting, DSGVO-Bewertung und Kostenrahmen — als umsetzbarer Fahrplan statt Folienstapel.