Offizielle Serviceregion: Republik Korea (Beta) · Abruf: weltweit · Registrierung, Zahlung & Support: Korea zuerst
TECHNOLOGIE · LLM-ENTWICKLUNG
KI-Experiment· Technik · StackASI and civilization language is a research and brand roadmap—not a claim about current product certification.
Dual-head culture LLM builds on Qwen3 4B-class open weights with XenLook fine-tuning, evaluation, and hosting. Dialogue (XenLook 4b-Ko) uses curated SFT then full fine-tuning; code (XenLook-Coder) uses QLoRA + micro-DPO. Tuning and TRACK run on NVIDIA DGX Spark (GB10); production vLLM runs on dedicated RTX GPUs. We do not claim foundation pretraining or universal SOTA.
Rezepte werden ausschließlich im Rahmen technischer Kooperationen und unter NDA geteilt.
LLM FÜR LOKALE KULTUR · ON-PREM
Lokale Speicherung · Inferenz · Vault. Getrennt vom Standard-Web-on.
Installierbarer Companion und Datenschutz als Produktgrenzen.
Lokales Kultur-LLM = nur Companion/Vault. Kein «souveränes KI-Unternehmen»-Anspruch. Grenzüberschreitende KI-Übertragung folgt Datenschutz §8④ und §12-Tabellen.
Companion On-Premise →ENTWICKLUNG · PRODUKTIONSINFRASTRUKTUR
DGX Spark dient als Workstation für Tuning und Evaluierung. Der produktive Service läuft auf einem separaten GPU-Server.
NVIDIA DGX Spark (GB10 Grace Blackwell) — SFT · Full-FT · DPO-Versuchsreihen · TRACK-DLG/CODER-Evaluierung · vLLM-Smoke-Tests
NVIDIA RTX GPU × vLLM · LiteLLM xenlook-4b-ko / xenlook-coder · on·Companion-Routing-Spine
XenLook 4b-Ko: Qwen3 4B-Klasse → kuratiertes SFT → **Full Fine-Tuning** → IF-Reparatur-Betriebspfad. XenLook-Coder: QLoRA c1 → micro-DPO-Merge (**kein Full-FT**). Beide Modelle basieren auf Open-Weight-Backbone-Optimierung, nicht auf einem Pretraining von Grund auf.
Mitglied des NVIDIA Inception Programms (Stufe 1). Keine offizielle NVIDIA-Fallstudie oder Produktempfehlung, bis NVIDIA diese offiziell publiziert.
KOREANISCHE DATEN · HERKUNFT
Wir legen nur die Phasen der Pipeline offen, ausgehend von öffentlichen Quellen. Filterregeln, Quellenmix und Details zum Golden-Set werden nur unter NDA geteilt.
AI Hub Rohdaten 20M+ Zeilen
Kuratierung · Deduplizierung · Qualitäts-Gates ~900K SFT
Aktueller Dialog-Engine Prod-Mix 24K
AI Hub-Datensätze unterliegen den jeweiligen Lizenzen und Richtlinien. Persona 144K SFT ist ein separater Pfad zur Nemotron 7M-Quelle (CC BY 4.0). Dies bedeutet nicht „wir haben 20M von Grund auf neu erstellt“ — es handelt sich um öffentliche Quellen → XenLook-Kuratierungspipeline.
KI-Richtlinien · Datenquellen →PRESSE · BEWERTUNGEN
Self-measured benchmark scores in plain language. Not a global #1 or third-party audit claim.
Dialog · Full Fine-Tuning
Wahrgenommener Dienst
82%
DQ100 prod ion · Gemini holistic judge · N=100 · 2026-08-18
88.0/100
user_quality · hard_fail 0%
91.42%
IF-Reparatur-Verbund · abgeschlossen am 30.06.2026 · historische Basislinie
Jede Achse nutzt einen individuellen Pfad, ein Datum und eine Methodik. Es handelt sich nicht um einen einzigen Gesamtwert.
Programmierung · QLoRA+DPO
84 Punkte
Zusammengesetzter Python-Programmier-Benchmark (Durchschnitt aus HumanEval und MBPP). Repräsentative Aufgabe HumanEval: 91 Punkte.
Eigenes Protokoll · Inferenz A2 (best-of-4) · gemessen am 08.07.2026
XenLook 4b-Ko self-benchmark composite 91 pts (closed 2026-06-30). Self-protocol measurement pending third-party audit.
MODELLKARTE
Detaillierte Rezepturen nur bei bestehender Geheimhaltungsvereinbarung (NDA).
Promoted to production · July 2026
Dialog · Full Fine-Tuning
Koreanischer Persona-Dialog
Programmierung · QLoRA+DPO
Python EvalPlus Codegenerierung
ROADMAP · (DESIGN GOAL)
Termine und Kennzahlen können sich ändern.
2026 · VERFÜGBAR
Vollständiges FT-Dialog + QLoRA+DPO Code · DGX Spark Tuning · RTX-Produktionsumgebung
2027+ · (Entwicklungsziel)
Companion/On-Prem/Edge Dual-Head — EU/US Open-Weight-Kandidaten: Llama 3.2 1B · SmolLM2-1.7B · Gemma 2 2B · Gemma 3n E2B · Granite 3.1 2B (noch offen, TRACK-Gate erforderlich)
2027+ · (Entwicklungsziel)
TRACK-Gates haben Vorrang
We do not claim benchmark superiority without published audit evidence.