EULLM
Legal IT: erstes Vertikale · Datensatz fast vollstÀndig · Q3 2026

7B-Spezialisten, die mithalten oder ĂŒbertreffen sollen
70B-Generalisten

in Ihrem regulierten Sektor, auf Ihrer EU-Infrastruktur.

EuLLM destilliert und vertikalisiert Open-Weight-Modelle zu kompakten 7B-Spezialisten fĂŒr die Bereiche Recht, Medizin und Technik. In der EU gehostet, mit AI Act-KonformitĂ€tskarten inklusive.

Entwickelt fĂŒr Rechtsteams, Compliance-Beauftragte, medizinische Einrichtungen und technische Organisationen die keine Daten in US-Clouds senden können.

70B → 7B
Modellkomprimierung
~50×
Inferenzkosten vs. Frontier
Vision+Audio
Multimodal, vollstÀndig lokal
AI Act
KonformitÀtskarten integriert
Forge

Die vertikale Modellschmiede

Nehmen Sie ein 70B-Frontier-Modell und destillieren Sie es zu einem schlanken 7B- oder 4B-DomĂ€nenspezialisten, der das Original in Ihrem Zielbereich ĂŒbertrifft. Weniger Rechenaufwand, mehr PrĂ€zision, volle EU-SouverĂ€nitĂ€t.

  • Structural pruning: irrelevante KapazitĂ€t entfernen, ohne von Grund auf neu zu trainieren
  • Knowledge distillation: DomĂ€nenexpertise in ein kleineres Modell ĂŒbertragen
  • Quantization: Throughput auf bestehender Hardware maximieren
  • Identity fine-tuning: individuelle Persona, Brand Voice und Anweisungen
  • GGUF-Export: lĂ€uft sofort auf Engine, kein zusĂ€tzliches Tooling erforderlich
1

Basismodell auswÀhlen

Beliebiges Apache 2.0-Frontier-Modell (70B, 32B
)

2

Ihren Sektor definieren

Recht, Medizin, Finanzen, Technik


3

Forge-Pipeline starten

Prune → Distill → Quantize → Fine-tune

4

Exportieren & bereitstellen

GGUF-Ausgabe, lÀuft sofort auf Engine

Hub

EuropÀisches Modellregister

Vorspezializierte vertikale Modelle fĂŒr regulierte europĂ€ische Branchen, vollstĂ€ndig innerhalb der EU gehostet. Jedes Modell wird mit einer AI Act-KonformitĂ€tskarte geliefert.

Erstes Vertikale: Datensatz fast vollstÀndigQ3 2026

Legal IT

Vertragsanalyse, GDPR-Bewertung, EU-RegulierungskonformitÀt (italienische Rechtsordnung)

Pipeline in Bearbeitung
  • →Trainiert auf kuratierter italienischer Rechtsprechung, Zivilgesetzbuch und EU-Regulierungskorpus
  • →7B Parameter, AI Act-KonformitĂ€tskarte fĂŒr Hochrisiko-KI inklusive
  • →Destilliert aus einem 70B-Frontier-Open-Weight-Modell
Medizin

Klinische Dokumentation, ICD-Kodierung, UnterstĂŒtzung bei der Patiententriagle

Ab 2026 verfĂŒgbar
Finanzen

Risikobewertung, KYC-Automatisierung, MiFID II-KonformitÀtsberichterstattung

Ab 2026 verfĂŒgbar

Benötigen Sie ein Vertikale, das wir noch nicht haben?

Wir entwickeln maßgeschneiderte Spezialmodelle fĂŒr Ihren regulierten Sektor.

Kontaktieren Sie uns →

Alle Hub-Modelle verwenden ausschließlich Gewichte unter Apache 2.0 Lizenz und bieten White-Label-SouverĂ€nitĂ€t fĂŒr europĂ€ische Unternehmen. VollstĂ€ndige Roadmap ansehen →

Engine

Die Laufzeitumgebung, die alles beschleunigt

Ein produktionsreifer Inferenz-Server in Rust: direkter Ollama-Ersatz mit OpenAI-kompatibler API. Engine betreibt jedes vertikale EULLM-Modell mit 259 Tok/s ohne jegliche Telemetrie außerhalb der EU. API auf dem Ollama-Standardport (11434), integrierte Chat-OberflĂ€che auf 11435, keine Konflikte.

  • Multimodal (Vision + Audio): Bild-OCR, Szenenbeschreibung, Audiotranskription, vollstĂ€ndig lokal auf Consumer-GPUs
  • Continuous batching: 259 Tok/s bei 16 gleichzeitigen Anfragen
  • GPU-Beschleunigung: NVIDIA CUDA (getestet), AMD ROCm, Vulkan, Apple Metal
  • Quantized KV cache: Q4_0/Q5/Q8 fĂŒr ~2-4× Kontext auf derselben GPU
  • Transparentes Web-Browsing (--web), model-agnostic, funktioniert mit jedem GGUF
  • Dual-Listener: API auf :11434 (Ollama-Standard), Chat-OberflĂ€che auf :11435 (~29 KB im BinĂ€rformat, kein CDN)
  • Integriertes Audit-Logging fĂŒr EU AI Act-KonformitĂ€t
  • Standalone-BinĂ€rdateien: Linux x64 + Windows x64 getestet · macOS & ARM64 experimentell
terminal

# Download Engine (Linux x64)

curl -L https://github.com/eullm/eullm/releases/latest/download/eullm-linux-x64 -o eullm

chmod +x eullm

# Run a model

./eullm run ./model.gguf --batch-size 16

# OpenAI-compatible API on :11434

curl http://localhost:11434/v1/chat/completions \

-H "Content-Type: application/json" \

-d '{"model":"qwen3","messages":[{"role":"user","content":"Ciao!"}]}'

SouverÀne KI beginnt hier

Ihre Daten bleiben in Europa. Ihre Modelle tragen Ihre Marke. Keine API-AbhÀngigkeiten, kein Vendor Lock-in.